Qwen3.8 LiveTranslate służy do tłumaczenia mowy na bieżąco. Według Alibaba średnie opóźnienie mierzone wskaźnikiem LAAL spadło z około 2,8 do 2,3 sekundy.
Opublikowane przezEdytowane za pomocą GPT-6 SolObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
W zapowiedziach Alibaba związanych z konferencją Apsara 2026 łatwo pomylić dwa różne zadania. Qwen3.8-LiveTranslate ma tłumaczyć rozmówcę na bieżąco. Qwen-Audio-3.1 to z kolei rodzina pięciu modeli dla aplikacji, które rozpoznają mowę, analizują nagrania, odpowiadają głosem lub tworzą dźwięk. 3
14
Qwen3.8-LiveTranslate jest modelem do tłumaczenia symultanicznego: przetwarza wypowiedź w trakcie jej trwania, zamiast czekać na koniec nagrania. Alibaba przypisuje jego architekturze Interleave większą wierność, płynność i zwięzłość przekładu. Firma podaje też, że LAAL — wskaźnik średniego opóźnienia tłumaczenia — spadł z około 2,8 do 2,3 sekundy. To różnica pół sekundy, czyli około 18%. Zarówno wynik pomiaru, jak i poprawa jakości są deklaracjami firmy, a nie rezultatami niezależnego testu. 3
7
W rozmowach wieloosobowych model ma rozróżniać mówców w czasie rzeczywistym. Alibaba opisuje również zsynchronizowany widok tekstu oryginalnego i tłumaczenia oraz wykorzystanie wcześniejszego kontekstu do wyjaśniania niejednoznaczności. Dokumentacja platformy Model Studio wskazuje tłumaczenie na żywo i tłumaczenie symultaniczne jako zastosowania modelu. 7
1
Qwen przedstawia tę serię jako trzy ulepszone modele — ASR, TTS i Realtime — oraz dwa nowe: ASR-Next i TTS-Next. Skrót ASR oznacza automatyczne rozpoznawanie mowy, a TTS — zamianę tekstu na mowę. 14
Najważniejsza różnica: zwykły TTS odczytuje tekst, natomiast TTS-Next ma tworzyć całe sceny dźwiękowe. Alibaba wskazuje audiobooki, film i telewizję, podcasty oraz gry jako planowane zastosowania. Nie oznacza to jednak, że wygenerowany materiał będzie gotowy do publikacji bez dalszej obróbki. 3
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 LiveTranslate służy do tłumaczenia mowy na bieżąco. Według Alibaba średnie opóźnienie mierzone wskaźnikiem LAAL spadło z około 2,8 do 2,3 sekundy.
Qwen3.8 LiveTranslate służy do tłumaczenia mowy na bieżąco. Według Alibaba średnie opóźnienie mierzone wskaźnikiem LAAL spadło z około 2,8 do 2,3 sekundy. Pięć modeli Qwen Audio 3.1 obejmuje transkrypcję, szerszą analizę nagrań, syntezę mowy, rozmowy głosowe oraz tworzenie całych scen dźwiękowych.