अलीबाबा के मुताबिक, Qwen3.8 LiveTranslate में अनुवाद की औसत देरी का LAAL माप लगभग 2.8 से घटकर 2.3 सेकंड हुआ है। Qwen Audio 3.1 के पांच मॉडल आवाज़ को टेक्स्ट में बदलने से लेकर संवाद, ध्वनि प्रभाव और माहौल की आवाज़ें तैयार करने तक के कामों के लिए हैं।
प्रकाशितकर्ताGPT-6 Sol से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
अगर कोई व्यक्ति बोल रहा हो और उसी वक्त उसकी बात दूसरी भाषा में सुननी हो, तो उसके लिए Qwen3.8-LiveTranslate है। अगर किसी ऐप को रिकॉर्डिंग लिखनी हो, आवाज़ में जवाब देना हो या पूरी ऑडियो सामग्री बनानी हो, तो वे काम Qwen-Audio-3.1 के पांच अलग-अलग मॉडल संभालते हैं। अलीबाबा की Apsara 2026 से जुड़ी ऑडियो घोषणाओं को समझने का यही सबसे सीधा तरीका है। 3
14
Qwen3.8-LiveTranslate वक्ता की बात पूरी होने का इंतज़ार किए बिना अनुवाद देने के लिए बनाया गया है। अलीबाबा का कहना है कि इसकी Interleave तकनीक से अनुवाद की अर्थ के प्रति निष्ठा, प्रवाह और संक्षिप्तता बेहतर हुई है। कंपनी के अनुसार, औसत अनुवाद-विलंब का माप LAAL लगभग 2.8 सेकंड से घटकर 2.3 सेकंड हो गया है—यानी करीब आधा सेकंड, या लगभग 18% की कमी। गुणवत्ता और गति के ये कंपनी के दावे हैं, स्वतंत्र परीक्षण के नतीजे नहीं। 3
7
कई लोगों की बातचीत के लिए मॉडल में वक्ताओं को अलग-अलग पहचानने, मूल और अनूदित टेक्स्ट साथ दिखाने तथा पहले कही गई बातों के संदर्भ से अस्पष्ट अर्थ समझने जैसी क्षमताएं भी बताई गई हैं। अलीबाबा क्लाउड का Model Studio इसे एक साथ बोले जाने वाले अनुवाद और लाइव ट्रांसलेशन के उपयोगों में सूचीबद्ध करता है। 7
1
Qwen के अनुसार, इस समूह में ASR, TTS और Realtime के उन्नत संस्करण हैं, जबकि ASR-Next और TTS-Next नए मॉडल हैं। ASR का मतलब आवाज़ को टेक्स्ट में बदलना और TTS का मतलब टेक्स्ट से आवाज़ बनाना है। 14
TTS और TTS-Next का मुख्य फर्क यही है: पहला टेक्स्ट को आवाज़ देता है; दूसरा आवाज़ के साथ पूरे दृश्य का ध्वनि-माहौल बनाने के लिए है। अलीबाबा इसे ऑडियोबुक, फ़िल्म और टीवी, पॉडकास्ट तथा गेम्स के लिए उपयोगी बताता है। यह उसके प्रस्तावित उपयोगों की सूची है—इस बात का प्रमाण नहीं कि तैयार ऑडियो को बिना संपादन के सीधे इस्तेमाल किया जा सकेगा। 3
24
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
अलीबाबा के मुताबिक, Qwen3.8 LiveTranslate में अनुवाद की औसत देरी का LAAL माप लगभग 2.8 से घटकर 2.3 सेकंड हुआ है।
अलीबाबा के मुताबिक, Qwen3.8 LiveTranslate में अनुवाद की औसत देरी का LAAL माप लगभग 2.8 से घटकर 2.3 सेकंड हुआ है। Qwen Audio 3.1 के पांच मॉडल आवाज़ को टेक्स्ट में बदलने से लेकर संवाद, ध्वनि प्रभाव और माहौल की आवाज़ें तैयार करने तक के कामों के लिए हैं।