Qwen3.8-27B是基于Qwen3.5基础构建的原生视觉-语言模型,采用**混合门控DeltaNet(Hybrid Gated DeltaNet)**注意力机制:每四个注意力子层中有三个使用线性复杂度O(n)注意力,从而无需二次方内存增长即可处理长上下文。来自官方Hugging Face模型卡的主要规格包括:
| 属性 | 详情 |
|---|---|
| 参数量 | 约270亿(部分来源报告总计约280亿) |
| 架构 | 密集Transformer,混合门控DeltaNet + 门控注意力 |
| 上下文窗口 | 原生262,144 token,可通过YaRN方法扩展至约100万 |
| 模态 | 文本、图像和视频输入;支持可切换思考模式 |
| 许可证 | Apache 2.0(权重完全开放) |
| 量化后大小 | 约17GB(4位,可在消费级GPU上运行) |
此次发布解答了发布前的诸多猜测。它意外集成了视觉编码器——多模态能力在发布前并未被承诺——而Apache 2.0许可证则消除了此前阻碍企业采用中国AI模型的法律障碍。
阿里巴巴在Qwen3.8-27B的Hugging Face模型卡上发布了完整的基准测试表格。该表格将这款27B开源模型与Meta的Muse Glimmer-30B、阿里自家仅限API的Qwen3.7-Plus、Anthropic的Opus4.6 Max以及前代Qwen3.6-27B进行了比较。
| 基准测试 | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1(智能代理终端编码) | 73.0 | 51.7 | 64.0 | 78.2 | 63.4 |
| SWE-bench Pro(智能代理软件工程) | 61.7 | — | 57.6 | — | 53.5 |
| CoWorkBench(办公/智能代理协作) | 70.7 | — | 65.1 | — | — |
| LiveCodeBench v6(竞赛级编码) | 90.3 | — | 89.6 | 88.8 | 83.9 |
| IFBench(指令遵循) | 79.5 | 77.0 | 79.1 | 62.5 | 69.1 |
三大突出结果:
相比前代Qwen3.6-27B,新款模型在Terminal-Bench上提升了约15%(73.0分对比63.4分),在SWE-bench Pro上提升了8个百分点。Qwen3.8-27B在LiveCodeBench v6上还取得了90.3分,为所有对比模型中最高。
Qwen3.8-27B的发布标志着战略转变。此前,阿里Qwen系列正趋向于将其最佳模型保留在API之后;在此之前最后一个通用的完全开源模型是2026年4月22日发布的Qwen3.6-27B 。Qwen3.8-27B采用Apache 2.0许可,并结合其能在消费级硬件上运行的能力,标志着阿里回归到曾为Qwen赢得全球声誉的开源策略。
这一点之所以重要,是因为中国AI模型正经历前所未有的采用激增。到2026年年中,源自中国的模型在OpenRouter上的token流量占比已达到约61%,而美国模型的份额在一年内从约70%骤降至30% 。另一项估算显示,截至2026年7月,中国开源模型每周处理的企业API token占比达46%,而美国模型为35.7% 。Gartner预测,受开源可用性、宽松许可和极具竞争力的价格驱动,两年内全球将有一半企业采用中国AI模型。
2026年3月,美中经济与安全审查委员会(USCC)的一份报告记录了一种“反馈循环”:中国AI的广泛采用推动了迭代,而迭代又进一步促进了采用——包括美国公司。Qwen3.8-27B采用的Apache 2.0许可直接促进了这一趋势,它消除了法律障碍,使任何组织都能在无需持续支付API费用的情况下自行托管前沿级别的多模态模型。
对于国内开发者和企业用户而言,Qwen3.8-27B最吸引人的地方莫过于其极低的部署门槛。在4位量化后,模型体积压缩至约17GB,这意味着你只需一张配备24GB显存的消费级显卡,就能在本地流畅运行这款拥有顶尖编码能力的AI助手。这无疑将极大降低中小企业和个人开发者尝试前沿AI技术的成本。