Qwen3.8-Max 采用 稀疏混合专家架构(Sparse Mixture-of-Experts, MoE),这是 Qwen Max 系列中首款采用此设计的模型 。其总参数量高达 2.4 万亿,但每次处理 token 时,仅激活约 950 亿参数,即总参数的约 4%,从而大幅降低推理成本 。
模型支持 100 万 token 的上下文窗口(实际最大输入约 99.1 万 token,开启思考模式后降至约 98.3 万 token),最大输出可达 13.1 万 token 。这是 Qwen 系列中首个参数量超过 1 万亿且支持原生多模态输入的模型,可处理文本、图片和视频,输出仅为文本 。
在独立 Arena 排行榜上,Qwen3.8-Max 表现出色 :
被称为 Arena 上排名最高的中文文本模型,以及视觉领域全球第二 。在 PaperBench 上取得最高分 93.0 ;Terminal-Bench 2.1 得分为 86.6,领先于 Claude Opus 4.8 和 Claude Fable 5(均为 84.6),但落后于 GPT-5.6 Sol 的 88.8 。
API 通过 QwenCloud 和阿里云模型服务平台即刻上线 :
开源权重(包括 Qwen3.8-Max 和较小的 Qwen3.8-27B)预计于 2026 年 8 月 10 日左右发布——这是 Qwen Max 系列首次开源 。
据路透社 2026 年 8 月 7 日的独家报道,阿里巴巴计划要求 Qwen3.8-Max 开源权重的大型商业用户协商收入分成协议 。此举效仿了月之暗面(Moonshot AI)为 Kimi K3 制定的许可模式:年销售额超过 2000 万美元的转售商需向月之暗面支付高达 30% 的收入分成 。
关键细节(基于路透社及多家确认性报道):
这标志着阿里 Qwen 系列的重大转向——此前所有 Qwen 开源模型均可无限制商业使用 。若该计划落地,阿里巴巴将成为一个月内第二家为开源权重附加商业条款的中国主要 AI 实验室 。
与 Qwen3.8-Max 同步,阿里巴巴推出了 QwenWork(中文名:千问办公),这是一站式职场 AI Agent 平台 。
QwenWork 支持文档处理、应用开发、多模态生成、网页制作、浏览器自动化和定时任务等场景,由新旗舰模型驱动 。
2026 年 8 月 10 日,阿里巴巴上线了 Qianwen 开放平台,向生态合作伙伴和第三方开发者开放,允许其构建可在手机、PC 和 AI 眼镜上运行的定制 AI Agent 应用 。这是阿里首次将此前内部使用的千问平台对外开放 。
首批合作伙伴覆盖物流、地产、财富管理等十余个行业,包括顺丰速运、自如、美的集团等 。
阿里 2026 年 8 月的这轮发布远不止是一款新模型,而是一套协同战略:
其中,收入分成模式对整个 AI 行业影响最为深远:如果这一模式被广泛采纳,将从根本上重新定义“开源 AI”商业实践中的含义——尤其对于大规模商业部署而言。