Qwen3.8-27B là mô hình ngôn ngữ - thị giác (vision-language) thuần chủng, xây dựng trên nền tảng Qwen3.5, sử dụng cơ chế chú ý Hybrid Gated DeltaNet, trong đó 3/4 lớp chú ý con sử dụng giải thuật tuyến tính O(n), cho phép xử lý ngữ cảnh dài mà không bùng nổ bộ nhớ . Các thông số chính từ trang model card chính thức trên Hugging Face :
| Thuộc tính | Chi tiết |
|---|---|
| Tham số | ~27 tỷ (một số nguồn ghi 28B) |
| Kiến trúc | Transformer dạng dense với Hybrid Gated DeltaNet + Gated Attention |
| Cửa sổ ngữ cảnh | 262.144 token gốc, có thể mở rộng lên ~1 triệu token qua YaRN |
| Phương thức | Nhập văn bản, hình ảnh và video; chế độ tư duy có thể bật/tắt |
| Giấy phép | Apache 2.0 (mở hoàn toàn trọng số) |
| Dung lượng nén | ~17 GB (4-bit, chạy được trên GPU tiêu dùng) |
Việc phát hành đã giải đáp nhiều thắc mắc trước đó. Mô hình này có một bộ mã hóa thị giác (vision encoder) bất ngờ — khả năng đa phương thức không được hứa hẹn trước khi ra mắt . Và giấy phép Apache 2.0 đã loại bỏ rào cản pháp lý vốn là rào cản cho các doanh nghiệp khi áp dụng các mô hình AI Trung Quốc .
Alibaba đã công bố bảng benchmark đầy đủ trên model card Hugging Face của Qwen3.8-27B . Bảng so sánh mô hình 27B mở này với Meta Muse Glimmer-30B, Qwen3.7-Plus (chỉ dùng API), Anthropic Opus4.6 Max và Qwen3.6-27B thế hệ trước .
| Benchmark | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1 (lập trình terminal tác tử) | 73,0 | 51,7 | 64,0 | 78,2 | 63,4 |
| SWE-bench Pro (kỹ thuật phần mềm tác tử) | 61,7 | — | 57,6 | — | 53,5 |
| CoWorkBench (cộng tác văn phòng/tác tử) | 70,7 | — | 65,1 | — | — |
| LiveCodeBench v6 (lập trình cạnh tranh) | 90,3 | — | 89,6 | 88,8 | 83,9 |
| IFBench (làm theo hướng dẫn) | 79,5 | 77,0 | 79,1 | 62,5 | 69,1 |
Ba kết quả nổi bật:
So với thế hệ trước (Qwen3.6-27B), mô hình mới cho thấy mức tăng khoảng 15% trên Terminal-Bench (73,0 vs. 63,4) và tăng 8 điểm trên SWE-bench Pro . Qwen3.8-27B cũng đạt 90,3 trên LiveCodeBench v6, cao nhất trong nhóm so sánh .
Việc phát hành Qwen3.8-27B đánh dấu một sự thay đổi chiến lược. Gia đình Qwen của Alibaba gần đây có xu hướng giữ các mô hình tốt nhất ở phía API; mô hình mã nguồn mở cuối cùng trước đó là Qwen3.6-27B, ra mắt từ ngày 22/4/2026 . Giấy phép Apache 2.0 trên Qwen3.8-27B, kết hợp với khả năng chạy trên phần cứng tiêu dùng, đánh dấu sự trở lại với chiến lược mở đã xây dựng danh tiếng toàn cầu của Qwen .
Điều này rất quan trọng vì các mô hình AI Trung Quốc đang có sự tăng trưởng vượt bậc. Đến giữa năm 2026, các mô hình AI có nguồn gốc từ Trung Quốc chiếm khoảng 61% khối lượng token trên OpenRouter, trong khi thị phần của Mỹ giảm từ khoảng 70% xuống còn 30% chỉ trong một năm . Một ước tính khác cho thấy các mô hình mã nguồn mở Trung Quốc xử lý 46% token API doanh nghiệp hàng tuần vào tháng 7/2026, so với 35,7% của các mô hình Mỹ . Gartner dự đoán một nửa số doanh nghiệp toàn cầu sẽ áp dụng các mô hình AI Trung Quốc trong vòng hai năm, nhờ vào khả năng mở, giấy phép cho phép và mức giá thấp hơn đáng kể .
Một báo cáo tháng 3/2026 của Ủy ban Đánh giá An ninh Kinh tế Mỹ-Trung (USCC) đã ghi nhận một "vòng lặp phản hồi" nơi việc áp dụng rộng rãi AI Trung Quốc thúc đẩy sự cải tiến, từ đó lại thúc đẩy việc áp dụng nhiều hơn nữa . Giấy phép Apache 2.0 trên Qwen3.8-27B trực tiếp tạo điều kiện cho xu hướng này bằng cách loại bỏ ma sát pháp lý và cho phép bất kỳ tổ chức nào tự lưu trữ một mô hình đa phương thức có khả năng tiên tiến mà không phải trả phí API liên tục .