阿里巴巴的Qwen 3.7 Max于2026年5月发布,是一款2.8万亿参数的混合专家(MoE)架构旗舰模型,在多项基准测试中表现与Anthropic的Fable 5相当或更优,而成本仅为其约六分之一 。针对高并发场景,阿里的Qwen3.6 Flash版本每百万输入token仅需0.19美元 。
智谱AI的GLM-5.2于2026年6月13日发布,采用7440亿参数MoE架构(每次激活约400亿参数),支持100万token上下文窗口,并在Artificial Analysis Intelligence Index中被评为排名第一的开源权重模型 。定价为每百万输入token 1.40美元、每百万输出token 4.40美元,比美国前沿模型便宜约5-6倍 。
月之暗面的Kimi K3于2026年7月16日亮相,是迄今宣布的规模最大的开源权重AI系统:总参数达2.8万亿,支持100万token上下文窗口,并具备原生视觉理解能力 。月之暗面承诺于2026年7月27日前完全开放权重 。其API定价为每百万输入token 3美元、每百万输出token 15美元,在中国模型中属于较高水平,但仍低于可比的美国产品 。
中国与美国前沿模型之间的成本鸿沟极为悬殊:
| 模型 | 输入价格(每百万token) | 输出价格(每百万token) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| Alibaba Qwen3.6 Flash | $0.19 | $1.13 |
| Zhipu GLM-5.2 | $1.40 | $4.40 |
| Alibaba Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5(估) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5(估) | ~$5.00 | ~$15.00 |
数据来源:
这些数字说明了问题:DeepSeek的V4-Flash每次基准测试的估算成本仅为3美分,而GPT-5.5需要1.86美元,Claude Fable 5则需要3.33美元 。风险投资人马克·安德森(Marc Andreessen)指出,GLM-5.2是“第一款在无妥协前提下与美国家大业大的AI实验室公开模型匹敌甚至常常超越的中国AI模型”——而价格仅为零头 。
中国AI战略的第二大支柱是开放权重发布。GLM-5.2(采用MIT开源协议)、Kimi K3(承诺采用修改版MIT协议)以及Qwen系列模型均可自由下载,这意味着任何人都可以免费运行、修改或微调这些模型,无需按token支付费用 。这种“免费送模型”的策略正在掏空美国公司过去赖以收取高额费用的中端市场 。
一个关键转折点发生在2026年6月:特朗普政府以国家安全为由要求Anthropic暂停其两个最先进AI系统(Fable和Mythos)的运营 。仅仅两周后,Z.ai就推出了与Anthropic产品性能相近的模型——价格更低、且不受美国限制 。中国公司看到了市场缺口并迅速填补 。
美国方面的应对措施支离破碎。Anthropic服从了政府要求;谷歌据报正在努力追赶其最新版Gemini模型,而中国模型的差距正在缩小 。目前尚无重大的协调性美国政策反制措施出台。分析人士指出,此前对芯片的出口管制并未阻止中国公司通过架构效率(如MoE、混合注意力机制)而非纯暴力算力实现有竞争力的性能 。
与此同时,美国公司基于成本原因正在越来越多地测试和采用中国模型,这进一步侵蚀了美国AI实验室的主场优势 。