在最大的中立LLM路由平台OpenRouter上,格局发生了剧变。到2026年5月,中国开源模型在OpenRouter上的Token消耗占比约为61%。在2026年2月24日那周,中国模型在前10大模型中占据了61%的Token消耗量,达到5.3万亿,总消耗量为8.7万亿。
在美国企业客户群体中,自2026年2月8日以来,中国产模型每周的Token消耗占比至少为30%,到2026年年中达到周峰值46%——而前十二个月的平均值仅为11%。到2026年5月,六家中国供应商的Token消耗总和占OpenRouter周消耗量的60%以上。到2026年春季,OpenRouter上最受欢迎的六个模型全部来自中国公司。
2026年,至少有八家中国主要实验室发布了具有竞争力的开源模型:
| 实验室/公司 | 2026年旗舰模型 | 许可协议 | 突出优势 |
|---|---|---|---|
| DeepSeek | V4-Pro, V4-Flash, V3.2-Speciale | MIT | 编程 (SWE-Bench 83.7%), AIME 96.0% |
| 阿里巴巴 (Qwen) | Qwen 3.6-Max Preview, Qwen3 (0.6B–235B MoE) | Apache 2.0 | 最广泛的采用,超过7亿次下载 |
| 月之暗面 (Kimi) | Kimi K2.6 | 开源 | SWE-Bench Pro 58.6% |
| 智谱AI (Z.ai) | GLM-5.2 | MIT | 媲美Anthropic Mythos,成本仅为1/5至1/6 |
| MiniMax | M2.5 | 开源 | OpenRouter上消耗Token最多的模型 |
| 小米 | MiMo | 开源 | 新入局者,OpenRouter排名前6 |
| 字节跳动 | 豆包 | 开源 | 特定领域优势 |
| 腾讯 | 混元 | 开源 | OpenRouter排名前6 |
中国实验室在2026年发布的有竞争力的开源模型数量超过了世界其他国家的总和。其中六家中国顶级模型采用宽松的(MIT或Apache 2.0)许可协议。
中国开源模型正在美国企业内部直接取代Anthropic和OpenAI的模型。Anthropic的Claude Opus 4.7在OpenRouter的人气排名中滑落至第七位,排在六个中国开源模型之后。Z.ai的GLM-5.2(2026年6月13日以MIT许可发布)在Artificial Analysis的智能指数上排名第四,在Code Arena的前端编程排行榜上排名第二——这是开源模型在封闭前沿系统面前达到的最高位置。它的网络安全基准测试成绩与Anthropic受限制的Mythos模型相当,但成本仅为其一小部分。
DeepSeek V4在SWE-Bench上的得分超过81%,在编程性能上与Claude相当,但每Token成本仅为十分之一。Anthropic CEO Dario Amodei警告称,西方公司正因10倍的成本优势从Claude转向中国模型(DeepSeek、Qwen、Kimi)。美国政府决定阻止外国用户访问Anthropic的Mythos 5和Fable 5模型(2026年6月)适得其反,反而推动了中国开源模型的采用,因为全球客户寻求不受限制的替代方案。财富杂志报道称,“Fable事件”为更便宜的中国模型打开了大门。
推动这一转变的主要驱动力并非意识形态,而是残酷的成本计算。CNBC于2026年7月7日报道,美国公司正通过OpenRouter等平台,悄悄地将越来越多的AI工作负载路由到中国开源模型上,这些平台可以比较实时定价和性能。中国模型以美国前沿模型1/5到1/10的成本提供了相当的质量。企业“模型路由”——为每个任务指派最便宜且足够胜任的模型——已成为标准做法,OpenRouter是关键的中立聚合平台。
美中经济与安全评估委员会发布了一份报告,评估了中国AI公司的竞争威胁,结论是“中国实验室已缩小了与西方顶尖大语言模型之间的性能差距”。美国政府此前已采取措施限制Anthropic的模型向外国用户开放,这一举措被广泛批评为适得其反,因为它加速了中国替代方案的采用。多份报告显示,华盛顿正在积极考虑对中国AI模型实施联邦采购限制,但截至2026年年中尚未出台最终禁令。商业内幕网指出,美国对Anthropic的限制可能会“加强提供更开放模型的AI公司的地位”,并给中国“一个机会来论证依赖美国AI供应商会带来地缘政治风险”。
斯坦福HAI DigiChina简报(2025年12月)记录了中国开源生态系统的多样性,并指出北京一直在权衡自己的政策应对措施,包括可能对AI模型海外分发进行管控。然而,截至2026年春季,中国实验室继续以宽松许可(MIT、Apache 2.0)向全球发布模型。纽约时报报道称,中国模型“目前在美国未受到任何限制”,北京方面尚未采取行动限制海外访问——很可能因为当前的流动有利于中国的战略利益。
Hugging Face CEO(Clem Delangue) 在Hugging Face 2026年春季开源现状报告中指出,生态系统仍然高度集中:Hugging Face上大约一半的模型总下载量不足200次,而前200个下载量最高的模型(占所有模型的0.01%)占据了绝大多数的下载量。这种集中化风险——将依赖从一家美国封闭供应商转向少数几家占主导地位的中国开源模型系列——成为了一个核心担忧。
2026年春季标志着一个明确的转折点:在宽松许可和5到10倍成本优势的推动下,中国开源模型在Hugging Face下载量(占比41%,累计11.5亿次)和OpenRouter Token消耗量(占比60%以上)上双双超越美国模型。至少有八家中国实验室展开了激烈竞争,Anthropic在排名上被挤至第七位,而华盛顿则匆忙制定政策应对。以Hugging Face CEO等人为代表提出的行业核心担忧是,这种转变有可能用一种形式的供应商集中取代另一种。