Alibaba Cloud ghép ba nhu cầu Model, Harness và Context với ba lớp AI Native Cloud, Agent Native Cloud và Context Engine.[3][4]
Qwen3.8 LiveTranslate được thiết kế để phiên dịch đồng thời. Alibaba cho biết độ trễ trung bình theo chỉ số LAAL giảm từ khoảng 2,8 xuống 2,3 giây; đây là số liệu do hãng công bố.
Một nhà nghiên cứu phát hiện ZCode có thể đóng gói không gian làm việc, gồm lịch sử Git, rồi mã hóa và tải lên dịch vụ lưu trữ đám mây của Alibaba Cloud.
Huawei cho biết một cụm OceanStor M900 có thể cung cấp 64 PB bộ nhớ đệm KV dùng chung; đây không phải dung lượng bộ nhớ nằm trong từng NPU.
Trong phép so sánh mô hình MoE cùng cấu hình, với 80 tỷ tham số tổng và khoảng 3 tỷ tham số hoạt động trên mỗi token, HySparse2 cần ít FLOPs tiền xử lý hơn 5,02 lần ở 1 triệu token so với Hybrid SWA; bộ nhớ...
Qwen Intelligence là bộ phần mềm AI Alibaba cung cấp cho các hãng điện thoại, không phải mẫu điện thoại do Alibaba sản xuất.
Ra mắt tại Apsara Conference 2026, Qwen Book là dự án máy tính xoay quanh tác nhân AI của Alibaba Cloud.[1][6]
Ra mắt tại Thượng Hải ngày 17/9/2026, Atlas 960E SuperPoD được Huawei công bố có thể kết nối tối đa 4.096 NPU, đạt mức tính toán tối đa 8 EFLOPS ở FP8 hoặc 16 EFLOPS ở FP4.
DSec cung cấp môi trường để AI agent gọi công cụ, chạy mã và thực hiện tác vụ trong quá trình huấn luyện tăng cường, đánh giá.
SenseTime công bố bản chính thức của SenseNova U1 Pro ngày 21/9/2026, trên ứng dụng Raccoon và qua SenseNova API.
Ra mắt ngày 23/9/2026, Spark ASR 2.0 được iFLYTEK cho là giảm lỗi nhận dạng và tạo bản chép lời mạch lạc hơn bản 1.0, trong khi chi phí suy luận tăng khoảng 10%.
Ngày 22/9/2026, XFEON giới thiệu một ma trận gồm chip, trạm tính toán Xinghui Token, vòng lặp dữ liệu XGAIA và mô hình AI hiện thân AGLobe.