Alibaba mengetengahkan Qwen3.8 LiveTranslate untuk terjemahan serentak dan lima model Qwen Audio 3.1 untuk tugas audio yang berbeza. Alibaba mendakwa ukuran kelewatan terjemahan LiveTranslate turun daripada kira kira 2.8 kepada 2.3 saat; angka itu bukan keputusan ujian bebas.
Diterbitkan olehDisunting dengan GPT-6 SolImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pengumuman audio Alibaba di Persidangan Apsara 2026 lebih mudah difahami jika dibahagikan kepada dua: menterjemah perbualan yang sedang berlangsung dan membina aplikasi berasaskan audio. Qwen3.8-LiveTranslate ditujukan kepada tugas pertama. Lima model dalam siri Qwen-Audio-3.1 pula mengendalikan tugas seperti menyalin pertuturan, menjana suara, berbual secara langsung dan mencipta adegan bunyi. 3
14
Qwen3.8-LiveTranslate direka untuk penterjemahan serentak. Menurut Alibaba, seni bina Interleave meningkatkan ketepatan penyampaian makna, kelancaran dan keringkasan terjemahan. Syarikat itu turut melaporkan bahawa LAAL, ukuran purata kelewatan terjemahan, turun daripada kira-kira 2.8 kepada 2.3 saat—perbezaan setengah saat, atau sekitar 18%. Ini ialah dakwaan prestasi Alibaba, bukan hasil pengujian bebas. 3
7
Untuk perbualan yang melibatkan beberapa orang, Alibaba menyatakan model ini boleh membezakan penutur secara langsung, memaparkan teks asal dan terjemahan secara segerak, serta menggunakan konteks perbualan terdahulu untuk memahami ungkapan yang samar. Dokumentasi Model Studio Alibaba Cloud menyenaraikan penterjemahan serentak dan terjemahan langsung sebagai kegunaannya. 7
1
Menurut Qwen, ASR, TTS dan Realtime ialah tiga keupayaan yang dinaik taraf. ASR-Next dan TTS-Next pula ialah dua model baharu. ASR bermaksud pengecaman pertuturan automatik, manakala TTS bermaksud penukaran teks kepada pertuturan. 14
Perbezaan TTS-Next paling jelas apabila dibandingkan dengan TTS biasa: satu menghasilkan pertuturan daripada teks, manakala satu lagi bertujuan membina adegan bunyi. Alibaba mencadangkan penggunaannya untuk buku audio, filem dan televisyen, podcast serta permainan. Itu ialah sasaran penggunaan kreatif, bukan jaminan bahawa audio yang dijana terus memenuhi semua keperluan produksi tanpa suntingan. 3
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba mengetengahkan Qwen3.8 LiveTranslate untuk terjemahan serentak dan lima model Qwen Audio 3.1 untuk tugas audio yang berbeza.
Alibaba mengetengahkan Qwen3.8 LiveTranslate untuk terjemahan serentak dan lima model Qwen Audio 3.1 untuk tugas audio yang berbeza. Alibaba mendakwa ukuran kelewatan terjemahan LiveTranslate turun daripada kira kira 2.8 kepada 2.3 saat; angka itu bukan keputusan ujian bebas.
TTS Next boleh menjana dialog, kesan bunyi dan bunyi latar dalam satu proses, melangkaui sintesis pertuturan biasa.