| 模型 | 輸入(美元/百萬token) | 輸出(美元/百萬token) | 同DeepSeek V4 Flash比較 |
|---|---|---|---|
| DeepSeek V4 Flash | $0.14 | $0.28 | 1倍(基準) |
| DeepSeek V4 Pro | $0.435 | $0.87 | 約3倍 |
| 阿里巴巴 Qwen 3.6 Plus | $0.33 | $1.95 | 約2至7倍 |
| OpenAI GPT-5.5 | 約$5.00 | 約$30.00 | 約12至107倍 |
| Claude Opus 4.8 | 約$15.00 | 約$25.00 | 約54至89倍 |
關鍵數據點:
根據美國國家標準與技術研究院(NIST)嘅CAISI獨立評估,DeepSeek V4 Pro直接同OpenAI同Anthropic嘅頂級模型競爭:
| 測試指標 | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond(科學推理) | 90.1% | 96% | 91% |
| MMLU-Pro(廣泛知識) | 87.5% | 約92% | 89.1% |
| SWE-bench Verified(編程能力) | 80.6% | 約75% | 約78% |
更多性能亮點:
中國AI嘅金融故事同技術故事一樣戲劇性:
阿里巴巴(Qwen) 採取開源生態系統策略:大部分模型用Apache 2.0授權發布,容易微調,免費自行託管。呢個策略令Qwen成為Hugging Face上下載量最大嘅模型家族。代價係變現困難——《紐約時報》報道,阿里巴巴嘅AI雖然受歡迎,但好難直接賺錢。不過,阿里巴巴已經開始轉向:旗艦模型Qwen 3.6 Max Preview喺2026年4月以封閉、專有API形式發布。
DeepSeek 採取混合模式:佢開放V4權重(MIT授權,1.6兆參數混合專家模型,490億活躍參數),同時提供平價API服務。佢嘅架構——極度稀疏激活嘅混合專家模型——令到前沿性能嘅推理成本大幅降低。
西方巨頭(OpenAI、Anthropic、Google)主要依賴封閉、專有API,定價較高。OpenAI同Anthropic已經推出更平嘅「nano」同「mini」級別以應對壓力,但冇一個能夠匹配DeepSeek喺前沿級別嘅價格性能比。