阿里巴巴嘅 Qwen 3.7 Max 喺 2026 年 5 月推出,係一個 2.8 兆參數嘅混合專家(MoE)旗艦模型,喺基準測試上似乎追平甚至超越咗 Anthropic 嘅 Fable 5,但成本淨係大約六分之一 。至於大量使用場景,阿里巴巴嘅 Qwen3.6 Flash 每百萬輸入 tokens 只係 US$0.19 。
智譜 AI 嘅 GLM-5.2 喺 2026 年 6 月 13 日發布,採用 7440 億參數嘅 MoE 架構(活躍參數 400 億),備有 100 萬 tokens 嘅上下文窗口,喺 Artificial Analysis Intelligence Index 上被評為排名第一嘅開源權重模型 。定價每百萬輸入 tokens US$1.40、每百萬輸出 tokens US$4.40,比美國 frontier 模型平大約 5 到 6 倍 。
Moonshot AI 嘅 Kimi K3 喺 2026 年 7 月 16 日亮相,係有史以來宣布過最大嘅開源權重 AI 系統:總參數達到 2.8 兆、100 萬 tokens 嘅上下文窗口,仲有原生嘅視覺理解能力 。Moonshot 承諾喺 2026 年 7 月 27 日前完全開放權重 。佢嘅 API 定價係每百萬輸入 tokens US$3、每百萬輸出 tokens US$15,係中國模型入面最貴嘅一款——但仍然比同級嘅美國產品平 。
中國同美國 frontier 模型之間嘅成本差距極端到一個點:
| 模型 | 輸入價格(每百萬 tokens) | 輸出價格(每百萬 tokens) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| 阿里巴巴 Qwen3.6 Flash | $0.19 | $1.13 |
| 智譜 GLM-5.2 | $1.40 | $4.40 |
| 阿里巴巴 Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5(估算) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5(估算) | ~$5.00 | ~$15.00 |
資料來源:引用上面個表同
數字好清楚:DeepSeek V4-Flash 每次基準測試嘅成本估計係 3 美仙,相比之下 GPT-5.5 要 US$1.86,Claude Fable 5 要 US$3.33 。風險投資者 Marc Andreessen 就話,GLM-5.2 係「第一個中國 AI 模型可以喺冇任何妥協嘅情況下,追平甚至經常打贏美國大實驗室嘅公開 AI 模型」,但價錢只係一個零頭 。
中國策略嘅第二條腿係開放權重。好似 GLM-5.2(MIT 授權)、Kimi K3(承諾用 Modified MIT 授權)同 Qwen 系列,全部都係免費下載嘅——任何人都可以用、改或者微調,唔使俾 per-token 費用 。呢種「送模型」嘅策略直接掏空咗中價市場,美國公司以往喺呢度可以收 premium 價錢 。
一個關鍵轉捩點係 2026 年 6 月,當時特朗普政府以國家安全為理由,要求 Anthropic 停止營運佢哋兩個最新嘅 AI 系統(Fable 同 Mythos)。兩星期之內,Z.ai 就推出咗一個同 Anthropic 產品好接近嘅模型——更平,而且冇美國嗰啲限制 。中國公司睇到個缺口,即刻衝入去填補 。
美國方面嘅反應到目前為止仲係好散。Anthropic 順應咗政府嘅要求。Google 據報喺佢最新嘅 Gemini 模型上面遇到困難,而中國模型就一步步逼近 。暫時仲未有大型嘅協調政策反擊;分析師指出,晶片出口管制並冇阻止到中國公司透過架構效率(例如 MoE、混合注意力機制)嚟達到有競爭力嘅表現,而唔係靠硬啃算力 。
與此同時,愈來愈多美國公司因為成本問題而開始測試同採用中國模型,呢個趨勢進一步蠶食咗美國 AI 實驗室嘅主場優勢 。