| 版本 | 總參數 | 活躍參數 | 上下文視窗 | 最大輸出 |
|---|---|---|---|---|
| V4-Pro | 1.6 兆 (MoE) | 每 token 約 49B | 100 萬 tokens | 384K tokens |
| V4-Flash | 2840 億 (MoE) | 每 token 約 13B | 100 萬 tokens | 384K tokens |
兩種版本均為多模態 (文字、圖片、影片),支援 JSON 輸出與工具呼叫,並可透過 API 與網頁存取 。
| 版本 | 輸入 (離峰) | 輸出 (離峰) | 快取命中 |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | 90% 折扣 |
| V4-Flash | $0.14 | $0.28 | 90% 折扣 |
DeepSeek 還曾在 2026 年 5 月初對 V4-Pro 提供 75% 的折扣促銷 。相比之下,GPT-5.5 的輸出定價約為每百萬 token 30 美元,這使得 V4-Flash 的輸出成本大約便宜了 107 倍 。
DeepSeek V4 的基準測試結果展現了細微的差異:
來自 NIST CAISI 評估 (2026 年 5 月) 的重要提醒: DeepSeek 自行報告的基準測試聲稱與 GPT-5.4 和 Opus 4.6 相當,但 CAISI 的獨立評估發現 V4 在非公開基準測試上「明顯能力較弱」,顯示部分自行報告的成績可能被高估 。Artificial Analysis 的智慧指數將 GPT-5.5 (高) 評為 53,而 DeepSeek V4 Pro (推理,高努力模式) 則為 41*——GPT-5.5 在智慧與速度 (每秒 69 對 56 tokens) 上均更勝一籌,但 DeepSeek 的價格極為低廉 (推理模式下每百萬 token 0.18 美元對 4.35 美元) 。
阿里巴巴的 Qwen 團隊於 2026 年 7 月 19 日 在上海世界人工智慧大會上預覽了 Qwen 3.8 Max 。這是該團隊首個超過 1 兆參數的旗艦模型。
| 屬性 | 詳細資訊 |
|---|---|
| 總參數 | 2.4 兆 (稀疏 MoE) |
| 架構 | 混合專家,多模態 (已確認文字與視覺) |
| 上下文視窗 | 依 Qwen Cloud 端點為 983,616 tokens ;部分來源重複提及約 100 萬 |
| 最大輸出 | 64,000 tokens |
| 授權 | 尚未公布;阿里巴巴表示「即將」開放權重 |
尚未公布即用定價。目前僅能透過 Qwen Chat 及特定 API 合作夥伴的訂閱方式存取。BenchLM 將 Qwen 3.8 Max Preview 的定價列為「未列出」。部分第三方追蹤工具顯示自動定價為每百萬輸入/輸出 tokens 1.50/5.00 美元,但此資訊未經阿里巴巴證實 。
阿里巴巴宣稱 Qwen 3.8 「僅次於 Fable 5」(Anthropic 的頂級 Claude 模型),這在阿里巴巴自己的排名中意味著其表現領先 GPT-5.5 和 DeepSeek V4 。號稱在程式碼生成、專業生產力、全端開發、數據分析及辦公流程等方面均較 Qwen 3.7 Max 有所提升 。
然而,目前沒有公開任何獨立的基準測試結果。基準測試追蹤網站 BenchLM 截至 2026 年 7 月 20 日,為 Qwen 3.8 Max Preview 追蹤了 321 項基準測試,其中 0 項獲得驗證 。正如某項分析所言:「Qwen 3.8 值得測試,但現在就將其視為 Kimi K3、GPT-5.6 Sol 或 Claude Fable 5 的穩定生產替代品,為時過早」 。
作為背景,Qwen 的前代模型已打下堅實基礎:Qwen 3.6-Max-Preview (2026 年 4 月 20 日) 是一個總參數 35B / 活躍參數 3B 的純文字模型,具備 262K 上下文,曾宣稱在六項程式碼與代理基準測試中取得第一 。Qwen 3.7-Max (2026 年 5 月) 將上下文視窗擴展至 100 萬 tokens,並具備推理代理能力 。但這兩者除了在代理式程式碼生成領域外,普遍不被視為達到前沿水準。
阿里巴巴明確將 Qwen 3.8 定位為「僅次於 Fable 5」。如果這項說法在獨立評估中獲得證實,將使 Qwen 3.8 的排名領先 GPT-5.5,並大幅超越 DeepSeek V4。然而,在沒有任何已驗證基準測試的情況下,這目前仍屬行銷宣傳,而非既定事實。根據阿里巴巴自身的陳述,Anthropic 的 Fable 5 似乎是當前公認的前沿領導者 。
DeepSeek 的激進定價已引發 API 成本的向下競爭。V4-Flash 每百萬 token 輸入僅 0.14 美元,遠低於任何西方前沿模型。阿里巴巴尚未設定 Qwen 3.8 的價格,但其前代 Qwen 3.6 的定價已相當積極 (約輸入/輸出每百萬 token 1.25/7.50 美元) 。
DeepSeek V4 採用 MIT 開源授權,意味著亦可自行託管,進一步壓縮了封閉原始碼供應商的利潤空間 。正如某項分析所指出的,實際效應是「開發者現在能夠以 GPT-5.5 或 Claude 零頭的成本,獲得接近前沿的能力 (在程式碼生成任務上)。」