オープンウェイトモデルは、2026年8月25日のVercel AI Gatewayでトークン量の54%を占め、プロプライエタリモデルの46%を上回った。直前の土曜日には過去最高の62%に達した。 主な牽引役はDeepSeek V4 Flash。更新された重みでエージェント性能が大きく向上しながら、効率重視の価格帯を維持した。
研究の答え

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
VercelのAI Gatewayで、AIモデルの選ばれ方が変わり始めている。大量のトークンを処理する用途では、最高性能のモデルを一律に選ぶのではなく、必要十分な性能と低い推論コストを両立するモデルへ処理を振り分ける動きが強まっている。
2026年8月25日(火)、オープンウェイトモデルはVercel AI Gatewayを通過したトークン量の54%を占め、プロプライエタリモデルの46%を上回った。さらに、その直前の土曜日にはオープンウェイトモデルの比率が過去最高とされる62%に達し、プロプライエタリモデルは38%だった。4
| 8月の観測時点 | オープンウェイトモデル | プロプライエタリモデル |
|---|---|---|
| 直前の土曜日 | 62% | 38% |
| 8月25日(火) | 54% | 46% |
8月25日時点でオープンウェイトモデルは8ポイント差、土曜日の過去最高時には24ポイント差でリードしていたことになる。
ただし、ここで比較されているのはゲートウェイを通過したトークン量だ。売上、利益、導入企業数、あるいは個別モデルを使った顧客数の比率を示す数字ではない。
今回の変化を後押ししたのが、DeepSeek V4 Flashだ。Vercelによると、AI Gatewayでは更新版の重みがデフォルトで使われるようになり、Terminal-Benchのスコアは4月のプレビュー時の56.9から82.7へ上昇した。25.8ポイントの改善である。19
既存のアプリケーションでは、モデルIDやコードを変更しなくても新しい重みを利用できた。19 そのため、すでにDeepSeek V4 Flashを組み込んでいる開発者にとって、導入し直す手間をかけずに性能向上の恩恵を受けられる環境だった。
V4 Flashの魅力は、単に「安い」ことだけではない。コーディング、ツール利用、エージェント型ワークフローでの性能が改善したことで、大量の開発支援や自動化処理に使いやすくなった。Vercelの説明では、推論、ツール利用、暗黙的キャッシュに対応し、コンテキストウィンドウは100万トークンに及ぶ。27
価格差も、V4 Flashの利用拡大を支えた。Reutersによると、DeepSeek V4 Proの投入価格はV4 Flashの約9倍(入力)および14倍(出力)だった。17 独立比較でも、V4 Flashには大きな価格優位性が示されている。ただし、ベンチマークの結果はテスト内容や設定によって変わるため、単一の指標だけでモデルの優劣を決めることはできない。25
一方、VercelはAnthropicのFable 5を、長時間にわたる曖昧で複数段階のタスク向けのモデルとして位置づけている。3 利用可能な報道では、Fable 5の高価格を背景に企業需要が弱まったことが、プロプライエタリモデルの利用量低下と結び付けられている。4
もっとも、公開されているゲートウェイの数字だけで、すべての顧客やリクエストの減少理由を一つに特定することはできない。今回の動きは「オープンモデルがあらゆる用途で優れている」という判定というより、用途に応じたルーティングの結果と見る方が正確だろう。
このニュースを読むうえで最も重要なのが、利用量と売上を分けて考えることだ。
Vercelの過去の報告では、オープンウェイトモデルはゲートウェイのトークン量の29%を処理した一方、支出に占める割合は4%未満だった。44 入力・出力トークン単価がモデルごとに異なるため、より多くのトークンを処理しているモデルが、より多くの売上を生むとは限らない。
つまり、8月の逆転が示しているのは、オープンウェイトモデルがゲートウェイ上の大量処理を担うようになったことだ。プロプライエタリモデルは、より少ないトークン量でも、価格の高さによって支出の大きな割合を維持する可能性がある。
今回のデータからは、モデルを一つに固定するのではなく、処理内容ごとに使い分ける戦略が見えてくる。
Vercelの8月のトラフィックが示す大きな流れは、オープンウェイトモデルが「十分な性能」と「大幅に低いコスト」を組み合わせれば、本番環境の処理量を獲得できるということだ。DeepSeek V4 Flashはその分かりやすい例になったが、起きているのはプロプライエタリモデルの一斉交代ではない。各ワークロードを、安価で、かつ信頼できる範囲で処理できるモデルへ振り分ける時代が進んでいる。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
オープンウェイトモデルは、2026年8月25日のVercel AI Gatewayでトークン量の54%を占め、プロプライエタリモデルの46%を上回った。直前の土曜日には過去最高の62%に達した。
オープンウェイトモデルは、2026年8月25日のVercel AI Gatewayでトークン量の54%を占め、プロプライエタリモデルの46%を上回った。直前の土曜日には過去最高の62%に達した。 主な牽引役はDeepSeek V4 Flash。更新された重みでエージェント性能が大きく向上しながら、効率重視の価格帯を維持した。
ただし、オープンウェイトモデルがゲートウェイ上の支出の大半を占めたことを意味しない。過去のVercelデータでは、トークン量29%に対して支出は4%未満だった。