阿里巴巴于2026年8月13日至14日发布Qwen3.8 27B,采用Apache 2.0许可证,是一个密集架构的270亿参数多模态模型,原生支持26.2万token上下文,可扩展至约100万token 在智能代理编程测试(Terminal Bench 2.1)中,Qwen3.8 27B以73.0分领先Meta的Muse Glimmer 30B(51.7分)41%,在SWE bench Pro和CoWorkBench上也超越自家API模型Qwen3.7 Plus 该模型采用混合门控DeltaNet注意力机制(每四层中有三层使用线性复杂度O(n)注意力),4位量化后约17GB,适合单张消费级GPU部署,标志着阿里回归开源策略
研究答案

Create a landscape editorial hero image for this Studio Global article: What are the key details and benchmark results of Alibaba's newly released open-weight Qwen3.8-27B model — including its architecture, licen. Article summary: I need to search for information about these models. Let me start with the Qwen3.8-27B and work through the comparisons.. Topic tags: general, documentation, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make
2026年8月13日至14日,阿里巴巴Qwen团队正式发布Qwen3.8-27B——一款采用Apache 2.0许可、密集架构的270亿参数多模态模型。与采用专有许可、需要庞大服务器级硬件的2.4万亿参数旗舰模型Qwen3.8-Max不同,这款27B变体专为本地和私有化部署设计,在4位量化下仅需约17GB显存即可运行
。
Qwen3.8-27B是基于Qwen3.5基础构建的原生视觉-语言模型,采用**混合门控DeltaNet(Hybrid Gated DeltaNet)**注意力机制:每四个注意力子层中有三个使用线性复杂度O(n)注意力,从而无需二次方内存增长即可处理长上下文。来自官方Hugging Face模型卡的主要规格包括
:
| 属性 | 详情 |
|---|---|
| 参数量 | 约270亿(部分来源报告总计约280亿) |
| 架构 | 密集Transformer,混合门控DeltaNet + 门控注意力 |
| 上下文窗口 | 原生262,144 token,可通过YaRN方法扩展至约100万 |
| 模态 | 文本、图像和视频输入;支持可切换思考模式 |
| 许可证 | Apache 2.0(权重完全开放) |
| 量化后大小 | 约17GB(4位,可在消费级GPU上运行) |
此次发布解答了发布前的诸多猜测。它意外集成了视觉编码器——多模态能力在发布前并未被承诺——而Apache 2.0许可证则消除了此前阻碍企业采用中国AI模型的法律障碍。
阿里巴巴在Qwen3.8-27B的Hugging Face模型卡上发布了完整的基准测试表格。该表格将这款27B开源模型与Meta的Muse Glimmer-30B、阿里自家仅限API的Qwen3.7-Plus、Anthropic的Opus4.6 Max以及前代Qwen3.6-27B进行了比较
。
| 基准测试 | Qwen3.8-27B | Muse Glimmer-30B | Qwen3.7-Plus | Anthropic Opus4.6 Max | Qwen3.6-27B |
|---|---|---|---|---|---|
| Terminal-Bench 2.1(智能代理终端编码) | 73.0 | 51.7 | 64.0 | 78.2 | 63.4 |
| SWE-bench Pro(智能代理软件工程) | 61.7 | — | 57.6 | — | 53.5 |
| CoWorkBench(办公/智能代理协作) | 70.7 | — | 65.1 | — | — |
| LiveCodeBench v6(竞赛级编码) | 90.3 | — | 89.6 | 88.8 | 83.9 |
| IFBench(指令遵循) | 79.5 | 77.0 | 79.1 | 62.5 | 69.1 |
三大突出结果:
相比前代Qwen3.6-27B,新款模型在Terminal-Bench上提升了约15%(73.0分对比63.4分),在SWE-bench Pro上提升了8个百分点。Qwen3.8-27B在LiveCodeBench v6上还取得了90.3分,为所有对比模型中最高
。
Qwen3.8-27B的发布标志着战略转变。此前,阿里Qwen系列正趋向于将其最佳模型保留在API之后;在此之前最后一个通用的完全开源模型是2026年4月22日发布的Qwen3.6-27B 。Qwen3.8-27B采用Apache 2.0许可,并结合其能在消费级硬件上运行的能力,标志着阿里回归到曾为Qwen赢得全球声誉的开源策略
。
这一点之所以重要,是因为中国AI模型正经历前所未有的采用激增。到2026年年中,源自中国的模型在OpenRouter上的token流量占比已达到约61%,而美国模型的份额在一年内从约70%骤降至30% 。另一项估算显示,截至2026年7月,中国开源模型每周处理的企业API token占比达46%,而美国模型为35.7%
。Gartner预测,受开源可用性、宽松许可和极具竞争力的价格驱动,两年内全球将有一半企业采用中国AI模型
。
2026年3月,美中经济与安全审查委员会(USCC)的一份报告记录了一种“反馈循环”:中国AI的广泛采用推动了迭代,而迭代又进一步促进了采用——包括美国公司。Qwen3.8-27B采用的Apache 2.0许可直接促进了这一趋势,它消除了法律障碍,使任何组织都能在无需持续支付API费用的情况下自行托管前沿级别的多模态模型
。
对于国内开发者和企业用户而言,Qwen3.8-27B最吸引人的地方莫过于其极低的部署门槛。在4位量化后,模型体积压缩至约17GB,这意味着你只需一张配备24GB显存的消费级显卡,就能在本地流畅运行这款拥有顶尖编码能力的AI助手。这无疑将极大降低中小企业和个人开发者尝试前沿AI技术的成本。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
阿里巴巴于2026年8月13日至14日发布Qwen3.8 27B,采用Apache 2.0许可证,是一个密集架构的270亿参数多模态模型,原生支持26.2万token上下文,可扩展至约100万token
阿里巴巴于2026年8月13日至14日发布Qwen3.8 27B,采用Apache 2.0许可证,是一个密集架构的270亿参数多模态模型,原生支持26.2万token上下文,可扩展至约100万token 在智能代理编程测试(Terminal Bench 2.1)中,Qwen3.8 27B以73.0分领先Meta的Muse Glimmer 30B(51.7分)41%,在SWE bench Pro和CoWorkBench上也超越自家API模型Qwen3.7 Plus
该模型采用混合门控DeltaNet注意力机制(每四层中有三层使用线性复杂度O(n)注意力),4位量化后约17GB,适合单张消费级GPU部署,标志着阿里回归开源策略