Qwen3.8 LiveTranslate übersetzt Sprache, während noch gesprochen wird. Laut Alibaba sank die gemessene durchschnittliche Verzögerung von etwa 2,8 auf 2,3 Sekunden.
Veröffentlicht vonBearbeitet mit GPT-6 SolBilder erstellt mit GPT Image 2
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Bei Alibabas Audioankündigungen rund um die Apsara-Konferenz 2026 lohnt eine Unterscheidung: Qwen3.8-LiveTranslate ist für das Dolmetschen laufender Rede gedacht. Die fünf Modelle der Qwen-Audio-3.1-Reihe sind Werkzeuge für unterschiedliche Audioanwendungen – vom Verschriftlichen gesprochener Sprache bis zur Produktion ganzer Klangwelten. 3
14
Qwen3.8-LiveTranslate soll Übersetzungen ausgeben, während eine Person noch spricht. Alibaba führt Verbesserungen bei der Bedeutungstreue, Flüssigkeit und Kürze auf eine sogenannte Interleave-Architektur zurück. Zugleich sei der LAAL-Wert – ein Maß für die durchschnittliche Übersetzungsverzögerung – von etwa 2,8 auf 2,3 Sekunden gesunken. Das entspricht einer halben Sekunde oder rund 18 Prozent. Sowohl die Qualitätsverbesserungen als auch die Verzögerungswerte sind Angaben des Unternehmens, keine unabhängig bestätigten Testergebnisse. 3
7
Für Gespräche mit mehreren Beteiligten beschreibt Alibaba außerdem eine Sprecherzuordnung in Echtzeit, die gleichzeitige Anzeige von Original und Übersetzung sowie die Nutzung des bisherigen Gesprächsverlaufs, um mehrdeutige Formulierungen einzuordnen. Alibabas Model-Studio-Dokumentation nennt Simultandolmetschen und Live-Übersetzung als Einsatzgebiete. 7
1
Qwen stellt drei überarbeitete Fähigkeiten – ASR für automatische Spracherkennung, TTS für die Umwandlung von Text in Sprache und Realtime für Sprachdialoge – sowie zwei neue Modelle namens ASR-Next und TTS-Next vor. 14
Der Unterschied für Kreative: Während TTS einen Text vorliest, soll TTS-Next aus einem Skript eine umfassendere Tonspur machen. Alibaba nennt Hörbücher, Film und Fernsehen, Podcasts sowie Spiele als Einsatzfelder. Das beschreibt den vorgesehenen Nutzen – nicht den Nachweis, dass jede erzeugte Szene ohne Nachbearbeitung produktionsreif ist. 3
24
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
Qwen3.8 LiveTranslate übersetzt Sprache, während noch gesprochen wird. Laut Alibaba sank die gemessene durchschnittliche Verzögerung von etwa 2,8 auf 2,3 Sekunden.
Qwen3.8 LiveTranslate übersetzt Sprache, während noch gesprochen wird. Laut Alibaba sank die gemessene durchschnittliche Verzögerung von etwa 2,8 auf 2,3 Sekunden. Die fünf Modelle der Qwen Audio 3.1 Reihe übernehmen unterschiedliche Aufgaben – von Transkription und Sprachausgabe bis zu Sprachdialogen und der Erzeugung von Geräuschkulissen.