截至 2026 年 8 月 25 日,開放權重模型佔 Vercel AI Gateway 代幣流量 54%,專有模型則為 46%;此前一個星期六,開放權重模型曾創下 62% 的紀錄。 DeepSeek V4 Flash 是這波變化的主要推力:更新權重後,其代理工作表現明顯提升,同時維持效率導向的價格優勢。
研究答案

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Vercel AI Gateway 的流量變化,正凸顯生成式 AI 市場一個愈來愈重要的取捨:開發者未必會為每一項工作選擇能力最強、價格最高的模型,而是傾向按工作需求,在成本與效能之間分流。
2026 年 8 月 25 日,開放權重模型佔 Vercel AI Gateway 代幣流量的 54%,高於專有模型的 46%。此前一個星期六,開放權重模型的比例更曾達到 62%,專有模型則為 38%,創下報告所稱的紀錄。4
| 8 月的觀察時間 | 開放權重模型 | 專有模型 |
|---|---|---|
| 此前一個星期六 | 62% | 38% |
| 8 月 25 日(星期二) | 54% | 46% |
換句話說,開放權重模型在 8 月 25 日領先 8 個百分點;在更早的紀錄高位,領先幅度則達 24 個百分點。
不過,這裡比較的是經由 Gateway 處理的代幣數量,而不是營收、利潤,或採用各類模型的企業數目。代幣流量增加,只代表這些模型處理了更多工作量,不能直接推論它們帶來更多收入。
Vercel 表示,DeepSeek V4 Flash 已在 AI Gateway 預設使用更新後的權重。在 Terminal-Bench 測試中,模型分數由 4 月預覽版的 56.9 提升至 82.7,增加 25.8 個百分點。19
更關鍵的是,現有使用者不需要更改模型 ID 或應用程式程式碼,便能自動取得新版權重。19 這降低了重新測試、修改及部署的門檻,對大量運行中的編程助手、工具呼叫和 AI 代理工作流程尤其重要。
因此,DeepSeek V4 Flash 的吸引力並非只有「便宜」。更新後的版本在程式編寫、工具使用和代理式工作流程方面更具競爭力;另一方面,它仍屬效率導向的產品定位,讓開發者可以在大量推理工作中控制每個代幣的成本。Vercel列出的功能包括推理、工具使用及隱式快取,並支援 100 萬個代幣的上下文視窗。27
價格差距亦進一步強化了這種定位。路透社報道,DeepSeek V4 Pro 上市時的輸入價格約為 V4 Flash 的 9 倍,輸出價格約為 14 倍,反映兩者分別面向效率型與高階旗艦型需求。17 獨立比較同樣顯示 V4 Flash 具有顯著價格優勢,但不同測試和設定下的基準結果並不完全一致。25
現有報道將專有模型流量下滑,與企業對 Anthropic 高價 Fable 5 的需求轉弱連繫起來。4 對重視吞吐量和單位經濟效益、而非追求最高模型能力的工作而言,這個解釋具一定合理性;但目前的 Gateway 數據不足以證明所有客戶或每一項請求都由同一原因造成。
按照 Vercel 的產品描述,Fable 5 仍然針對長時間、模糊且需要多步驟處理的任務,能夠端到端執行一些以往需要人類頻繁介入的工作。3 因此,8 月的流量轉變與其說是開放模型全面勝出,不如說是模型路由策略變得更精細:大量而適合的工作交給成本較低的模型;只有在任務價值足以抵銷高昂價格時,才使用高階專有模型。
解讀這批數據時,最重要的界線是「使用量」與「收入」並不相同。Vercel 早前的報告顯示,開放權重模型曾佔 Gateway 代幣流量的 29%,但支出比例低於 4%。44
原因在於,不同模型的輸入和輸出代幣價格可能相差甚遠。因此,即使開放權重模型處理了更多代幣,專有模型仍可能在總支出中佔有不成比例的份額。
這也意味著,8 月的交叉點主要反映開放權重模型承載了更多 Gateway 工作量,而不是它們已經帶來更多平台收入,或在所有商業指標上超越專有模型。
這波流量變化,指向更有意識的模型分流策略:
Vercel 8 月的數據所呈現的更大趨勢是:當開放權重模型能以大幅較低的成本,提供足以應付生產環境的能力時,它們就可能在工作量上取得優勢。DeepSeek V4 Flash 是目前最鮮明的例子,但這並不代表專有模型會一夜之間被取代。更可能出現的局面,是開發者把每項工作交給「能可靠完成、而成本最低」的模型。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
截至 2026 年 8 月 25 日,開放權重模型佔 Vercel AI Gateway 代幣流量 54%,專有模型則為 46%;此前一個星期六,開放權重模型曾創下 62% 的紀錄。
截至 2026 年 8 月 25 日,開放權重模型佔 Vercel AI Gateway 代幣流量 54%,專有模型則為 46%;此前一個星期六,開放權重模型曾創下 62% 的紀錄。 DeepSeek V4 Flash 是這波變化的主要推力:更新權重後,其代理工作表現明顯提升,同時維持效率導向的價格優勢。
代幣流量不等於平台支出;Vercel 早前數據顯示,開放權重模型佔 29% 流量時,支出比例仍低於 4%。