| バリアント | 総パラメータ数 | 活性化パラメータ数 | コンテキストウィンドウ | 最大出力 |
|---|---|---|---|---|
| V4-Pro | 1.6兆 (MoE) | 約490億 / トークン | 100万トークン | 38万4000トークン |
| V4-Flash | 2840億 (MoE) | 約130億 / トークン | 100万トークン | 38万4000トークン |
両バリアントともマルチモーダル(テキスト、画像、動画)対応で、JSON出力やツール呼び出しをサポート。APIおよびWeb経由で利用可能である。
| バリアント | 入力(オフピーク) | 出力(オフピーク) | キャッシュヒット |
|---|---|---|---|
| V4-Pro | $0.435 | $0.87 | 90%割引 |
| V4-Flash | $0.14 | $0.28 | 90%割引 |
DeepSeekは2026年5月上旬まで、V4-Proに対して75%割引のプロモーションも実施していた。比較として、GPT-5.5の出力価格は約$30/MTokであり、V4-Flashは出力において約107倍も安い計算になる。
DeepSeek V4のベンチマーク結果は、複雑な実情を示している。
NIST CAISIによる評価(2026年5月)の重要な注意点: DeepSeekが自己報告するベンチマークはGPT-5.4やOpus 4.6と同等の性能を示唆しているが、CAISIの独立した評価では、非公開ベンチマークにおいてV4は「実質的に能力が低い」とされ、自己報告スコアの一部が過大である可能性が指摘されている。Artificial AnalysisのIntelligence Indexでも、GPT-5.5(high)が53であるのに対し、DeepSeek V4 Pro(Reasoning, High Effort)は41*と評価されており、GPT-5.5の方が知能インデックス、速度(69対56 tok/s)で優位に立つが、DeepSeekの価格は圧倒的に低い(推論モード時:$0.18対$4.35/MTok)。
AlibabaのQwenチームは、2026年7月19日に上海で開催されたWorld AI ConferenceにてQwen 3.8 Maxをプレビュー公開した。同チームにとって、1兆パラメータを超える初のフラッグシップモデルとなる。
| 属性 | 詳細 |
|---|---|
| 総パラメータ数 | 2.4兆(スパースMoE) |
| アーキテクチャ | Mixture-of-Experts、マルチモーダル(テキスト+画像確認済み) |
| コンテキストウィンドウ | Qwen Cloudエンドポイントで98万3616トークン ;一部ソースでは約100万トークンと繰り返し記載 |
| 最大出力 | 6万4000トークン |
| ライセンス | 未公開;Alibabaは「まもなく」オープンウェイト化すると表明 |
従量課金制の価格はまだ発表されていない。現在はQwen Chatおよび一部のAPIパートナーを通じたサブスクリプションでのみアクセス可能。BenchLMはQwen 3.8 Max Previewの価格を「未掲載」としている。一部のサードパーティトラッカーは自動価格を100万トークンあたり入力$1.50/出力$5.00と表示しているが、これはAlibabaによって確認されていない。
AlibabaはQwen 3.8が**「Fable 5(AnthropicのトップClaudeモデル)に次ぐ」**と述べており、これはAlibaba自身のランキングにおいてGPT-5.5やDeepSeek V4を上回る位置づけとなる。コーディング、プロフェッショナル生産性、フルスタック開発、データ分析、オフィスワークフローにおいてQwen 3.7 Maxからの向上が主張されている。
しかしながら、独立したベンチマークは一件も公開されていない。ベンチマーク追跡サイトBenchLMは、Qwen 3.8 Max Previewに関して321件のベンチマークを追跡しているが、2026年7月20日時点で検証済みの結果は0件である。ある分析記事は、「Qwen 3.8はテストする価値はあるが、Kimi K3、GPT-5.6 Sol、Claude Fable 5の安定したプロダクション代替として扱うには時期尚早」と評している。
参考までに、Qwenの先行モデルは強力な基盤を築いていた。Qwen 3.6-Max-Preview(2026年4月20日)は総パラメータ350億 / 活性化パラメータ30億、26万2000トークンのコンテキストを持つテキスト専用モデルで、6つのコーディングおよびエージェントベンチマークで首位を主張した。Qwen 3.7-Max(2026年5月)はコンテキストウィンドウを100万トークンに拡大し、推論エージェント機能を搭載した。しかし、いずれもエージェント型コーディング以外ではフロンティアレベルとは一般にみなされていなかった。
AlibabaはQwen 3.8を「Fable 5に次ぐ」と明示的に位置づけている。もしこの主張が独立した評価で裏付けられれば、Qwen 3.8はGPT-5.5やDeepSeek V4を凌駕し、AnthropicのFable 5に次ぐ存在となる。しかし、検証済みのベンチマークがゼロである現状、これはマーケティング上の主張に過ぎず、確定した事実ではない。Alibaba自身の表現によれば、AnthropicのFable 5が現在のフロンティアリーダーとして認識されているようだ。
DeepSeekの攻めの価格設定は、APIコストの底なし競争を引き起こした。V4-Flashの入力価格$0.14/Mは、西側のフロンティアモデルよりも桁違いに安い。AlibabaはまだQwen 3.8の価格を設定していないが、Qwen 3.6ですでに攻めの価格設定(約$1.25/$7.50 入出力)を行っていた。
DeepSeek V4がMITライセンスのオープンウェイトであることを意味し、セルフホスティングも可能であるため、クローズドソースのプロバイダーにとってはさらなるマージン圧縮要因となる。ある分析が指摘するように、現実的な影響として「開発者は、GPT-5.5やClaudeの数分の一のコストで、(コーディングタスクにおいて)フロンティアに近い能力にアクセスできるようになった」のである。