Qwen3.8 LiveTranslate, konuşmacı sözünü bitirmeden çeviri üretmek için tasarlandı. Qwen Audio 3.1 ailesindeki beş model; konuşmayı yazıya dökme, ses sentezi, etkileşimli konuşma, kapsamlı ses analizi ve ses sahnesi üretimi gibi farklı işlere ayrılıyor.
YayımlayanGPT-6 Sol ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Alibaba’nın Apsara 2026 çevresindeki ses duyurularını anlamanın en kolay yolu iki ihtiyacı ayırmak: Konuşmayı anında çevirmek ve sesle çalışan uygulamalar geliştirmek. Qwen3.8-LiveTranslate ilkine odaklanıyor. Beş modelden oluşan Qwen-Audio-3.1 ailesi ise sesi tanıma, üretme, analiz etme ve sesli etkileşim kurma görevlerini kapsıyor. 3
14
Qwen3.8-LiveTranslate, konuşma devam ederken çevrilmiş çıktıyı üreten bir simultane çeviri modeli. Alibaba’ya göre modelin Interleave mimarisi çevirinin anlamı korumasını, akıcılığını ve özlülüğünü iyileştiriyor. Şirket, ortalama çeviri gecikmesini ölçen LAAL değerinin yaklaşık 2,8 saniyeden 2,3 saniyeye düştüğünü bildiriyor. Bu, yarım saniyelik, yaklaşık %18’lik bir azalma demek; hız ve kaliteye ilişkin veriler bağımsız test sonucu değil, şirketin açıklamaları. 3
7
Birden fazla kişinin konuştuğu durumlar için de konuşmacıları gerçek zamanlı ayırt etme, kaynak metinle çeviriyi eşzamanlı gösterme ve belirsiz ifadeleri önceki konuşma bağlamından yararlanarak çözme özellikleri anlatılıyor. Alibaba Cloud’un Model Studio belgeleri modeli simultane çeviri ve canlı çeviri kullanım alanları arasında listeliyor. 7
1
Qwen, bu aileyi üç güncellenmiş model —ASR, TTS ve Realtime— ile iki yeni model —ASR-Next ve TTS-Next— olarak tanımlıyor. ASR, konuşmayı otomatik olarak tanıma; TTS ise metni konuşma sesine dönüştürme anlamına geliyor. 14
TTS ile TTS-Next arasındaki temel fark, seslendirmeden ses sahnesi üretimine geçiş. Alibaba, TTS-Next’i sesli kitaplar, sinema ve televizyon yapımları, podcast’ler ve oyunlar için konumlandırıyor. Bunlar hedeflenen kullanım alanları; üretilen bir sahnenin düzenleme gerektirmeden her yapımın ihtiyaçlarını karşılayacağı anlamına gelmiyor. 3
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 LiveTranslate, konuşmacı sözünü bitirmeden çeviri üretmek için tasarlandı.
Qwen3.8 LiveTranslate, konuşmacı sözünü bitirmeden çeviri üretmek için tasarlandı. Qwen Audio 3.1 ailesindeki beş model; konuşmayı yazıya dökme, ses sentezi, etkileşimli konuşma, kapsamlı ses analizi ve ses sahnesi üretimi gibi farklı işlere ayrılıyor.