阿里巴巴的Qwen 3.7 Max,於2026年5月推出,是一個2.8兆參數的混合專家(MoE)旗艦模型,在各項評測中表現與Anthropic的Fable 5匹敵甚至超越,而成本僅約六分之一 。針對高用量場景,阿里巴巴的Qwen3.6 Flash每百萬輸入代幣僅需0.19美元 。
智譜AI(Z.ai)的GLM-5.2,於2026年6月13日發布,採用7440億參數的MoE架構(活躍參數400億),擁有100萬代幣的上下文窗口,並在Artificial Analysis Intelligence Index上被評為排名第一的開源權重模型 。其定價為每百萬輸入代幣1.40美元、每百萬輸出代幣4.40美元,比美國前沿模型便宜約5至6倍 。
月之暗面(Moonshot AI)的Kimi K3,於2026年7月16日揭曉,是史上宣布的最大開源權重AI系統:總參數2.8兆、100萬代幣上下文窗口,並具備原生視覺理解能力 。月之暗面承諾於2026年7月27日全面開放權重 。其API定價為每百萬輸入代幣3美元、每百萬輸出代幣15美元,雖然是中國模型中最昂貴的,但仍低於同級的美國產品 。
中美前沿模型之間的成本差距極為巨大:
| 模型 | 輸入價格(每百萬代幣) | 輸出價格(每百萬代幣) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| Alibaba Qwen3.6 Flash | $0.19 | $1.13 |
| Zhipu GLM-5.2 | $1.40 | $4.40 |
| Alibaba Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5(估) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5(估) | ~$5.00 | ~$15.00 |
來源:引用上表及
數字說明了一切:DeepSeek的V4-Flash每次基準測試的平均成本估算僅3美分,相比之下,GPT-5.5為1.86美元,Claude Fable 5為3.33美元 。創投家馬克·安德森(Marc Andreessen)指出,GLM-5.2是「第一個在性能上與美國大實驗室公開AI模型匹配且常勝的中國AI模型,且毫無妥協」——價格卻僅為零頭 。
中國策略的第二個面向是開放權重發布。像GLM-5.2(MIT授權)、Kimi K3(承諾採修改版MIT授權)以及Qwen系列等模型,均可自由下載,這意味著任何人都可以免費執行、調整或微調它們,無需按代幣付費 。這種「把模型送出去」的策略,徹底掏空了美國公司過去可以收取高額費用的中階市場 。
一個關鍵轉折點出現在2026年6月,當時川普政府以國家安全為由,要求Anthropic停止其兩款最先進AI系統(Fable與Mythos)的營運 。不到兩週,Z.ai就推出了一個與Anthropic產品實力相當的模型——更便宜、並且在美國沒有任何限制 。中國公司看到了機會,並迅速填補了這個空缺 。
美國的回應顯得零散。Anthropic遵守了政府的要求。據報導,隨著中國模型逐漸逼近,Google正在與其最新版Gemini模型苦苦掙扎 。目前尚無大規模協調的美國政策反制措施被公布;分析師指出,對晶片的出口管制並未能阻止中國公司透過架構效率(例如MoE、混合注意力機制)而非蠻力運算來實現具競爭力的表現 。
與此同時,越來越多的美國公司基於成本考量,正在測試並採用中國模型,這進一步侵蝕了美國AI實驗室的主場優勢 。