Qwen3.8 LiveTranslate è dedicato all’interpretazione simultanea. Alibaba dichiara un ritardo medio di traduzione sceso da circa 2,8 a 2,3 secondi.
Pubblicato daModificato con GPT-6 SolImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Negli annunci audio legati alla conferenza Apsara 2026, Alibaba distingue due esigenze: tradurre una persona mentre parla e sviluppare applicazioni che ascoltano, rispondono o producono audio. Alla prima risponde Qwen3.8-LiveTranslate; alla seconda, la famiglia di cinque modelli Qwen-Audio-3.1. 3
14
Qwen3.8-LiveTranslate produce la traduzione mentre riceve il parlato. Secondo Alibaba, la sua architettura Interleave migliora fedeltà, scorrevolezza e concisione della traduzione e riduce il valore LAAL, una misura del ritardo medio, da circa 2,8 a 2,3 secondi: mezzo secondo in meno, pari a circa il 18%. Sono risultati dichiarati dall’azienda, non verifiche indipendenti. 3
7
Per le conversazioni a più voci, Alibaba descrive inoltre il riconoscimento in tempo reale di chi sta parlando, la visualizzazione sincronizzata del testo originale e della traduzione e l’uso del contesto precedente per sciogliere le ambiguità. La documentazione di Model Studio, la piattaforma cloud di Alibaba per accedere ai modelli, indica l’interpretazione simultanea e la traduzione dal vivo tra gli impieghi previsti. 7
1
La famiglia comprende tre capacità aggiornate — ASR, TTS e Realtime — e due nuovi modelli, ASR-Next e TTS-Next. ASR indica il riconoscimento automatico del parlato; TTS la conversione del testo in voce. 14
È soprattutto TTS-Next a segnare la differenza rispetto alla normale sintesi vocale. Alibaba lo propone per audiolibri, cinema e televisione, podcast e videogiochi. Si tratta degli usi previsti dall’azienda, non della garanzia che una scena generata sia pronta per la pubblicazione senza interventi di montaggio. 3
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 LiveTranslate è dedicato all’interpretazione simultanea. Alibaba dichiara un ritardo medio di traduzione sceso da circa 2,8 a 2,3 secondi.
Qwen3.8 LiveTranslate è dedicato all’interpretazione simultanea. Alibaba dichiara un ritardo medio di traduzione sceso da circa 2,8 a 2,3 secondi. I cinque modelli Qwen Audio 3.1 coprono trascrizione, comprensione dei suoni, sintesi vocale, conversazioni in tempo reale e creazione di scene sonore.