Qwen3.8 LiveTranslate được thiết kế để phiên dịch đồng thời. Alibaba cho biết độ trễ trung bình theo chỉ số LAAL giảm từ khoảng 2,8 xuống 2,3 giây; đây là số liệu do hãng công bố.
Đăng bởiBiên tập bằng GPT-6 SolHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What audio models did Alibaba unveil at the 2026 Apsara Conference, and what are their capabilities and intended uses—including Qwen3.8-Live. Article summary: At the 2026 Apsara Conference, Alibaba presented Qwen3.8-LiveTranslate for simultaneous interpretation and its Qwen-Audio-3.1 lineup for speech recognition, synthesis, live interaction and audio creation. The reported tr. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Nếu cần dịch ngay khi ai đó đang nói, mô hình đáng chú ý là Qwen3.8-LiveTranslate. Nếu cần xây dựng ứng dụng dùng giọng nói hoặc tạo nội dung âm thanh, Alibaba giới thiệu bộ năm mô hình Qwen-Audio-3.1. Đó là hai hướng sử dụng khác nhau trong các công bố quanh hội nghị công nghệ Apsara 2026. 3
14
Qwen3.8-LiveTranslate tạo bản dịch khi lời nói vẫn đang được tiếp nhận. Alibaba cho biết kiến trúc Interleave giúp bản dịch sát nghĩa, trôi chảy và ngắn gọn hơn, đồng thời giảm LAAL — chỉ số đo độ trễ trung bình của bản dịch — từ khoảng 2,8 xuống 2,3 giây. Mức chênh lệch là 0,5 giây, tương đương gần 18%. Đây là đánh giá và số liệu do công ty công bố, không phải kết quả kiểm chứng độc lập. 3
7
Với cuộc trò chuyện nhiều người, Alibaba mô tả khả năng phân biệt người nói theo thời gian thực, hiển thị đồng bộ lời gốc và bản dịch, đồng thời dựa vào ngữ cảnh trước đó để xử lý cách diễn đạt mơ hồ. Tài liệu Model Studio của Alibaba Cloud liệt kê phiên dịch đồng thời và dịch trực tiếp là các trường hợp sử dụng của mô hình này. 7
1
Theo Qwen, bộ Audio 3.1 gồm ba năng lực được nâng cấp — ASR, TTS và Realtime — cùng hai mô hình mới là ASR-Next và TTS-Next. Hiểu đơn giản, ASR nhận dạng lời nói, còn TTS biến văn bản thành giọng nói. 14
TTS-Next là điểm phân biệt rõ nhất giữa tổng hợp giọng nói và sản xuất một cảnh âm thanh. Alibaba định hướng khả năng này cho sách nói, phim và truyền hình, podcast, trò chơi. Đó là mục đích sử dụng mà hãng đề xuất, không có nghĩa âm thanh tạo ra sẽ đáp ứng mọi yêu cầu sản xuất mà không cần biên tập. 3
24
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Qwen3.8 LiveTranslate được thiết kế để phiên dịch đồng thời. Alibaba cho biết độ trễ trung bình theo chỉ số LAAL giảm từ khoảng 2,8 xuống 2,3 giây; đây là số liệu do hãng công bố.
Qwen3.8 LiveTranslate được thiết kế để phiên dịch đồng thời. Alibaba cho biết độ trễ trung bình theo chỉ số LAAL giảm từ khoảng 2,8 xuống 2,3 giây; đây là số liệu do hãng công bố. Năm mô hình Qwen Audio 3.1 đảm nhiệm các việc khác nhau: nhận dạng lời nói, hiểu âm thanh, tổng hợp giọng nói, hội thoại trực tiếp và tạo cảnh âm thanh.