Alibaba presenterte en modell for direkteoversetting og fem Qwen Audio 3.1 modeller med ulike oppgaver. Selskapet oppgir at gjennomsnittlig oversettelsesforsinkelse er redusert fra rundt 2,8 til 2,3 sekunder.
Publisert avRedigert med GPT-6 SolBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Det viktigste skillet i Alibabas lydnyheter fra Apsara-konferansen i 2026 er hva modellene skal brukes til. Qwen3.8-LiveTranslate er laget for å oversette tale fortløpende. Qwen-Audio-3.1 er en familie på fem modeller for å gjenkjenne og forstå lyd, lage tale, føre stemmesamtaler og produsere lydinnhold. 3
14
Qwen3.8-LiveTranslate er en modell for simultantolking: Den skal levere oversettelsen mens den som snakker, fortsatt har ordet. Alibaba sier at modellens såkalte Interleave-arkitektur gir mer korrekt, flytende og konsis oversettelse. Selskapet oppgir også at LAAL, et mål på gjennomsnittlig oversettelsesforsinkelse, er redusert fra rundt 2,8 til 2,3 sekunder. Det er et halvt sekund, eller omtrent 18 prosent. Både kvalitetsforbedringene og forsinkelsestallene er Alibabas egne opplysninger, ikke resultater fra uavhengig testing. 3
7
For samtaler med flere deltakere beskriver Alibaba funksjoner som skiller mellom talere i sanntid, viser originaltekst og oversettelse side om side og bruker tidligere deler av samtalen til å tolke tvetydige uttrykk. Alibaba Clouds dokumentasjon oppgir simultantolking og direkteoversetting som bruksområder. 7
1
Qwen omtaler Audio 3.1 som oppgraderinger av ASR, TTS og Realtime, i tillegg til de to nye modellene ASR-Next og TTS-Next. Forkortelsene ASR og TTS viser til talegjenkjenning og tekst-til-tale. 14
TTS-Next er dermed forskjellen mellom opplesning og en mer sammensatt lydscene i denne lanseringen. Alibaba trekker frem lydbøker, film og TV, podkaster og spill som aktuelle bruksområder. Det er en beskrivelse av hva modellen er ment for, ikke dokumentasjon på at resultatet kan brukes i en ferdig produksjon uten redigering. 3
24
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba presenterte en modell for direkteoversetting og fem Qwen Audio 3.1 modeller med ulike oppgaver.
Alibaba presenterte en modell for direkteoversetting og fem Qwen Audio 3.1 modeller med ulike oppgaver. Selskapet oppgir at gjennomsnittlig oversettelsesforsinkelse er redusert fra rundt 2,8 til 2,3 sekunder.
TTS Next skal kunne lage tale, lydeffekter og bakgrunnslyd samlet, mens de øvrige Audio 3.1 modellene blant annet håndterer transkripsjon og stemmesamtaler.