截至 2026 年 8 月 25 日星期二,開放權重模型佔 Vercel AI Gateway token 流量 54%,專有模型則佔 46%;較早前的星期六更創下 62% 的紀錄。 DeepSeek V4 Flash 是主要推手:更新權重後,代理式工作表現明顯提升,同時維持以效率及低成本為主的定位。
研究答案

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Vercel AI Gateway 的流量,正反映出 AI 模型市場一個愈來愈明顯的取捨:企業及開發者未必每次都需要最強模型,而是會按工作量、表現和每個 token 的成本,選擇「夠用而且平」的方案。
截至 2026 年 8 月 25 日星期二,開放權重模型佔 AI Gateway token 流量的 54%,超過專有模型的 46%。而在之前的星期六,開放權重模型更錄得 62% 的高位,專有模型佔 38%。4
| 8 月的數據時間點 | 開放權重模型 | 專有模型 |
|---|---|---|
| 之前的星期六 | 62% | 38% |
| 8 月 25 日星期二 | 54% | 46% |
換句話說,開放權重模型在星期二領先 8 個百分點,而在較早前的紀錄則領先 24 個百分點。
不過,這裏比較的是經 Vercel AI Gateway 處理的 token 數量,並不是收入、利潤,亦不是使用各類模型的企業數目。token 可以簡單理解為模型處理文字內容時所計算的基本單位;不同模型每個 token 的收費可以相差甚遠。
Vercel 表示,DeepSeek V4 Flash 已在 AI Gateway 預設採用更新後的權重,Terminal-Bench 得分由 4 月預覽版的 56.9 升至 82.7,增加 25.8 分。19
更方便的是,現有請求毋須更改模型 ID 或應用程式碼,就可以自動取得新權重。19 對於已經將模型接入生產環境的開發者來說,這大幅降低了重新測試及部署的門檻。
因此,V4 Flash 的吸引力不只是「夠平」。更新後的模型在編程、工具使用及代理式工作流程方面更有競爭力,較適合大量處理 coding agent、工具呼叫及其他高頻工作。Vercel 的產品資料亦顯示,模型支援推理、工具使用及隱式快取,並提供 100 萬 token 的上下文視窗。27
這個定位與 DeepSeek 的高階產品形成鮮明對比。路透社報道,DeepSeek V4 Pro 的輸入價格約為 V4 Flash 的 9 倍,輸出價格則約為 14 倍,凸顯兩者在效率型與旗艦型產品之間的價格差距。17 獨立比較亦顯示 V4 Flash 具備顯著價格優勢,但不同測試及配置所得的 benchmark 結果並不完全一致。25
現有報道將專有模型流量下跌,與企業對 Anthropic 高價 Fable 5 的需求轉弱連繫起來。4 對於重視吞吐量及單位成本、多過追求最高模型能力的工作,這個解釋確實合理;但目前的 Gateway 數據,並不足以證明所有客戶或每一個請求都由同一個原因造成轉向。
按 Vercel 的產品介紹,Fable 5 仍然針對長時間、含糊而且涉及多個步驟的複雜任務,目標是完成過往需要人類頻繁跟進的工作。3 因此,8 月的流量變化更像是模型路由策略轉變,而不是一個「開放模型全面勝出」的判決:大量而合適的工作交給較低成本模型,需要更深層能力的任務,則保留給較昂貴的專有模型。
最需要留意的,是使用量與收入之間的差別。
Vercel 早前公布的數據顯示,開放權重模型曾佔 Gateway token 流量的 29%,但所佔支出不足 4%。44 原因在於,單看 token 數量,無法反映輸入及輸出 token 各自的收費。
所以,8 月的交叉點代表開放權重模型處理了 Gateway 較多工作量,並不代表它們為模型供應商帶來較多生意。即使較便宜的開放模型處理更多 token,專有模型仍然可以憑較高的單價,佔據不成比例的總開支。
這些數據反映,模型選擇正由「揀一個最強的」變成更精細的路由安排:
Vercel 8 月的流量變化,顯示開放權重模型只要將能力提升至「足以可靠完成工作」,再配合明顯較低的成本,就可以在生產環境搶到大量使用量。DeepSeek V4 Flash 是其中最鮮明的例子,但更深層的趨勢,是開發者開始為每項工作配對一個在可靠性足夠的前提下、成本最低的模型,而不是一下子全面取代所有專有模型。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
截至 2026 年 8 月 25 日星期二,開放權重模型佔 Vercel AI Gateway token 流量 54%,專有模型則佔 46%;較早前的星期六更創下 62% 的紀錄。
截至 2026 年 8 月 25 日星期二,開放權重模型佔 Vercel AI Gateway token 流量 54%,專有模型則佔 46%;較早前的星期六更創下 62% 的紀錄。 DeepSeek V4 Flash 是主要推手:更新權重後,代理式工作表現明顯提升,同時維持以效率及低成本為主的定位。
開放模型搶佔的是處理 token 的數量,不等於佔據大部分平台開支;Vercel 早前數據顯示,專有模型即使處理較少 token,仍可能佔有大部分支出。