DeepSeek V4 Flashは、OpenRouterで入力100万トークン当たり0.05ドル、出力0.16ドルという掲載価格と約131万トークンのコンテキストを組み合わせ、コード生成・エージェント・大量文書処理の検証候補として注目を集めた。[1] 7月27日~8月2日のOpenRouter週間ランキングでは7.22兆トークンで首位。ただし7月31日の正式版公開より前のプレビュー利用も期間に含まれるため、新版だけの4日間の実績とは言えない。[3][5] 無料トライアルは初期利用を大きく押し上げうる。8月1日のOpenCodeでは、報道上の8兆トークンのうち5兆トークンが無料トライアル、3兆トークンが開発者による有料分だった...
研究の答え

Create a landscape editorial hero image for this Studio Global article: How did DeepSeek V4-Flash, launched in public API beta on July 31, 2026, become OpenRouter’s most-used model within four days—reaching 7.1 t. Article summary: The reported surge is best explained by an unusually strong cost–capability–context combination, amplified by OpenRouter’s low-friction routing and likely substantial trial traffic—not by architecture alone. But several . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek-V4-Flash-0731は、モデルの「標準設定」がいかに短期間で入れ替わり得るかを示す事例になった。低いトークン単価、大きなコンテキスト容量、そしてアグリゲーター経由ですぐ試せる導線が同時にそろったためだ。
TechNodeの報道によると、DeepSeek V4 Flashは7月27日から8月2日までのOpenRouter週間モデル利用ランキングで、7.22兆トークンを処理して首位となった。5 ただし、この数字を「正式版が公開から数日で生んだ利用量」とそのまま読むのは正確ではない。無料トライアルと、以前から存在したプレビュー版の利用という要素を分けて見る必要がある。
7月31日版のV4-Flash-0731は、総パラメータ数2840億、トークン当たりのアクティブ・パラメータ数130億の疎なMixture of Experts(MoE)モデルだ。OpenRouterは、コンテキストウィンドウを131万720トークンとし、コーディング、推論、エージェント型ワークフロー向けのモデルとして掲載している。1
この組み合わせは、トークン消費量が大きい用途にとって魅力的だ。
もっとも、MoEであること自体が、実運用での低コストや高品質を保証するわけではない。MoEは、各トークンで全パラメータではなく一部を有効化することで、大きなモデル容量を持ちながら、同規模の密モデルとは異なる計算コスト特性を目指す設計である。実際のメリットは、応答時間、提供事業者の供給能力、ルーティング、プロンプト設計、出力の長さによって変わる。
TechNodeは、DeepSeek V4 Flashが7月27日~8月2日のOpenRouter週間ランキングで7.22兆トークンを処理したと報じた。同記事では、中国系モデルが上位4枠を占め、DeepSeek V4 Flash 0731とV4 Proも上位6位以内に入ったとしている。5
一方で、この集計期間は7月31日のパブリックベータ公開より前から始まっている。V4 Flashには従来のプレビュールートが存在し、0731リリースはdeepseek-v4-flash APIエンドポイント上でそのプレビューを置き換えた。3 したがって、この週間合計を「新しい0731版だけが生んだ利用量」と表現することはできない。
無料アクセスも、初動を読むうえで重要な変数だ。同じ報道によれば、OpenCodeでは8月1日にこのモデルで8兆トークンが処理され、その内訳は無料トライアルが5兆トークン、開発者の有料利用が3兆トークンだった。5
無料トライアルは、開発者にモデルを触ってもらうための有効な施策であり、評価を始めるまでの心理的・金銭的な障壁を下げる。しかし、無料での試行量と、継続的な本番の有料需要は同じではない。
ここから導けるより慎重な結論は、V4-Flashが極めて速い配布・試用の広がりを得たということだ。初期の全ボリュームが有料の移行や継続的な本番利用を意味する証拠は、現時点の情報だけでは足りない。
API料金は、提供事業者、ルート、割引、キャッシュの有無、時点で変わる。7月31日リリースを扱った報道では、公式価格として、キャッシュなしの入力100万トークン当たり0.14ドル、出力100万トークン当たり0.28ドルが挙げられていた。一方、8月初旬のOpenRouterでは、ルートごとに異なる料金が掲載されていた。3
その後のOpenRouterにおける日付指定ルートdeepseek-v4-flash-0731の掲載料金は、入力100万トークン当たり0.05ドル、出力0.16ドル、キャッシュ読み出し0.013ドルである。1
このOpenRouter掲載料金を基準にすると、提供された比較対象との価格差は大きい。
| モデル | 掲載された入力/出力料金(100万トークン当たり) | V4-Flashの0.05/0.16ドル比 |
|---|---|---|
| DeepSeek V4-Flash-0731 | 0.05ドル/0.16ドル |
基準 |
| Kimi K3 | 3ドル/15ドル |
約60倍/94倍 |
| GPT-5.6 Sol | 5ドル/30ドル |
約100倍/188倍 |
| Claude Fable 5 | 10ドル/50ドル |
約200倍/313倍 |
これは公表リスト価格に基づく算術比較にすぎず、品質、速度、ツール利用の信頼性、安全性、稼働率が同等であることを示すものではない。また、普遍的な「1タスク当たりの費用」にも直結しない。実際の請求額は、入力・出力の長さ、キャッシュ、再試行、ツール呼び出し、プロバイダーの選択、上位モデルへのエスカレーション頻度に左右される。
Kimi K3、GPT-5.6 Sol、Claude Fable 5はいずれも高度なコーディングやエージェント用途に対応し得るが、相互に代替可能な同一製品として扱うべきではない。比較ソースでは、Kimi K3は2.8兆パラメータのMoEモデルで、100万トークンのコンテキストを持つとされる。GPT-5.6 Solは105万トークン、Claude Fable 5は100万トークンのコンテキストとして掲載されている。17
導入側にとって有用なのは、ブランドや思想ではなく、運用上の違いで選ぶことだ。
公開ベンチマークは候補を絞る助けになるが、単一スコアで本番の標準モデルを決めることはできない。元の主張にあった「Agent Ultimate」の25.2対25.7という比較は、提供された主要な形式のソースから独立して裏づけられなかったため、性能の近さを示す根拠として使うべきではない。DeepSeekのリリース情報には、Terminal Bench 2.1で82.7、NL2Repoで54.2といった数値は掲載されているが、ベンチマーク結果も自社ワークロードで検証する必要がある。10
中規模の開発チームが問うべきなのは、「どのモデルがリーダーボードで勝つか」ではない。実際の業務で十分に信頼でき、ルーティングや失敗のコストまで含めても、どれだけ費用を下げられるかである。
実務的な評価は、次の順で進めるとよい。
初期のトークン数がトライアルで押し上げられていたとしても、V4-Flashの台頭は重要だ。低摩擦のモデルアグリゲーターが、非常に低価格で長文脈の選択肢を、開発者に即時に試させることを示したからである。そのモデルが本番評価で十分な水準に達するなら、日常的な処理量を高価な既定モデルから移すきっかけになり得る。
提供された情報は、OpenRouterでの週間7.22兆トークン首位、先行プレビュー期間との重複、OpenCodeにおける無料トライアル分の存在を支持している。3
5
一方で、「中国系モデルが上位10のうち9枠を占めた」「米国モデルの呼び出し量を14週連続で上回った」「米国・欧州の開発者が広範に移行した」「実際の推論コストが60~85%削減された」「GPT-5.6 Lunaが特定の80%値下げを行った」といった主張を、十分に裏づける情報はない。
こうした主張には、OpenRouterの直接的なダッシュボードデータ、プロバイダーの料金記録、または再現可能なワークロード研究が必要になる。それまでの根拠に基づく結論は、より限定的だ。DeepSeek V4-Flashは、非常に低いルート掲載料金、大きなコンテキスト、広いアクセス性を、開発者がより安価なエージェント・コーディングモデルを試そうとしていた時期に提供した。急速な利用増を生むには十分な条件だが、それだけで恒久的な市場再編を証明するものではない。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
DeepSeek V4 Flashは、OpenRouterで入力100万トークン当たり0.05ドル、出力0.16ドルという掲載価格と約131万トークンのコンテキストを組み合わせ、コード生成・エージェント・大量文書処理の検証候補として注目を集めた。[1]
DeepSeek V4 Flashは、OpenRouterで入力100万トークン当たり0.05ドル、出力0.16ドルという掲載価格と約131万トークンのコンテキストを組み合わせ、コード生成・エージェント・大量文書処理の検証候補として注目を集めた。[1] 7月27日~8月2日のOpenRouter週間ランキングでは7.22兆トークンで首位。ただし7月31日の正式版公開より前のプレビュー利用も期間に含まれるため、新版だけの4日間の実績とは言えない。[3][5]
無料トライアルは初期利用を大きく押し上げうる。8月1日のOpenCodeでは、報道上の8兆トークンのうち5兆トークンが無料トライアル、3兆トークンが開発者による有料分だった。[5]