По данным Alibaba, Qwen3.8 LiveTranslate сократила среднюю задержку перевода по метрике LAAL примерно с 2,8 до 2,3 секунды. В линейке Qwen Audio 3.1 пять моделей: для расшифровки и анализа записей, синтеза речи, голосового общения и создания звуковых сцен.
ОпубликовалОтредактировано с помощью GPT-6 SolИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
На конференции Apsara 2026 Alibaba представила аудиоразработки для двух разных задач. Qwen3.8-LiveTranslate переводит речь, пока человек ещё говорит. Qwen-Audio-3.1 — линейка из пяти моделей для работы со звуком: от расшифровки записи до создания аудиосцены. 3
14
Qwen3.8-LiveTranslate предназначена для синхронного перевода. Alibaba утверждает, что архитектура Interleave повысила точность передачи смысла, плавность и лаконичность перевода. По данным компании, показатель LAAL — метрика средней задержки перевода — снизился примерно с 2,8 до 2,3 секунды. Разница составляет полсекунды, или около 18%. Эти цифры и оценки качества приводит сама Alibaba; независимыми результатами тестирования они не являются. 3
7
Для беседы с несколькими участниками компания также заявляет разделение реплик по говорящим в реальном времени, одновременный показ оригинала и перевода, а также учёт предыдущего контекста, когда фраза допускает разные толкования. В документации Alibaba Cloud модель указана как инструмент для синхронного и прямого перевода. 7
1
По описанию Qwen, ASR, TTS и Realtime получили обновления, а ASR-Next и TTS-Next стали двумя новыми дополнениями к линейке. Здесь ASR означает распознавание речи, а TTS — превращение текста в речь. 14
Главное различие между TTS и TTS-Next — озвучка текста против создания аудиосцены. Alibaba предлагает применять TTS-Next для аудиокниг, кино и телевидения, подкастов и игр. Это заявленные сценарии использования, а не гарантия, что полученная запись не потребует монтажа. 3
24
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
По данным Alibaba, Qwen3.8 LiveTranslate сократила среднюю задержку перевода по метрике LAAL примерно с 2,8 до 2,3 секунды.
По данным Alibaba, Qwen3.8 LiveTranslate сократила среднюю задержку перевода по метрике LAAL примерно с 2,8 до 2,3 секунды. В линейке Qwen Audio 3.1 пять моделей: для расшифровки и анализа записей, синтеза речи, голосового общения и создания звуковых сцен.