截至2026年8月25日,开放权重模型占 Vercel AI Gateway 代币处理量的54%,专有模型占46%;此前一个周六,开放权重模型份额曾达到62%。 DeepSeek V4 Flash 是这轮变化的主要推动者:更新权重显著提升了智能体任务表现,同时保留了面向效率和成本控制的定位。
研究答案

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Vercel AI Gateway 的流量变化,正在凸显生成式 AI 产业的一条新规律:在能力足够的前提下,更便宜的模型可以先赢得大规模生产任务。
2026年8月25日,开放权重模型占该网关代币处理量的54%,高于专有模型的46%。而在此前一个周六,开放权重模型份额一度达到报告中的纪录高点62%,专有模型则为38%。4
这里的“开放权重”是指模型权重可以被下载或以更开放的方式使用;“专有模型”则通常由模型提供商控制权重和服务方式。Vercel AI Gateway 本质上是一个统一入口,开发者可以通过单一接口调用不同厂商的模型。1
| 2026年8月报告节点 | 开放权重模型 | 专有模型 |
|---|---|---|
| 此前一个周六 | 62% | 38% |
| 8月25日(周二) | 54% | 46% |
换句话说,开放权重模型在8月25日领先8个百分点,在此前的纪录节点则领先24个百分点。
但这组数据只统计通过网关处理的代币数量,不能直接等同于收入、利润,或使用两类模型的企业数量。
Vercel表示,DeepSeek V4 Flash 已在 AI Gateway 上默认使用更新后的模型权重,其 Terminal-Bench 得分从4月预览版的56.9升至82.7,提升25.8个百分点。19
更重要的是,现有用户不需要更换模型 ID,也不必修改应用代码,就能自动获得更新后的权重。19 对已经将模型接入生产环境的开发者来说,这降低了重新迁移、测试和部署的门槛。
因此,V4 Flash 的吸引力并不只是“便宜”。更新后的模型在编程、工具调用和智能体工作流方面表现更强,更适合大批量代码生成、自动化操作和工具调用等任务;与此同时,它仍然保持效率型模型的成本定位。Vercel列出的能力包括推理、工具使用和隐式缓存,并支持100万代币的上下文窗口。27
价格进一步强化了 V4 Flash 的定位。路透社报道称,DeepSeek V4 Pro 的输入价格约为 V4 Flash 的9倍,输出价格约为后者的14倍。这凸显出 DeepSeek 在效率型产品与高端旗舰产品之间设置的价格梯度。17
独立对比也显示,V4 Flash 的价格优势十分明显,不过不同测试和配置下的基准结果并不完全一致。25 这意味着开发者面对的并不是简单的“哪个模型绝对更强”,而是“哪个模型能以更低成本可靠完成当前任务”。
现有报道将专有模型流量下滑,部分归因于企业对 Anthropic 高价 Fable 5 的需求走弱。4 对于更看重吞吐量和单位成本、而不是极限能力的工作负载,这一解释具有合理性;但目前公开的网关数据并不能证明所有客户或所有请求都由同一个原因驱动。
根据 Vercel 的产品介绍,Fable 5 仍然面向长期运行、目标模糊且包含多个步骤的复杂任务,能够处理此前往往需要人工频繁介入的工作。3
因此,8月的流量变化更像是一次模型路由策略的调整,而不是对开放模型的全面判决:大规模、适配度较高的任务交给低成本模型;只有在任务价值足以覆盖更高价格时,才调用高端专有模型。
理解这次变化时,最需要留意的是“使用量”和“收入”之间的差距。
Vercel此前发布的数据曾显示,开放权重模型占 AI Gateway 代币处理量的29%,但对应支出不足4%。44 原因在于,代币数量并不会反映每个输入或输出代币的单价。
所以,8月的交叉点说明开放权重模型处理了网关中更多的工作量,并不意味着它们为模型提供商带来了更多商业收入。更昂贵的专有模型即使处理的代币较少,也可能继续占据更高的支出份额。
这组数据指向一种更精细的模型路由方式:
Vercel 8月的流量数据传递出的更大信号是:当开放权重模型同时具备“够用的能力”和“显著更低的成本”时,它们完全可能在生产环境中赢得多数调用量。DeepSeek V4 Flash 是目前最醒目的案例,但真正发生的变化并不是所有专有模型会被一次性替代,而是开发者开始把每项任务交给那个“在可靠完成工作的前提下,成本最低”的模型。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
截至2026年8月25日,开放权重模型占 Vercel AI Gateway 代币处理量的54%,专有模型占46%;此前一个周六,开放权重模型份额曾达到62%。
截至2026年8月25日,开放权重模型占 Vercel AI Gateway 代币处理量的54%,专有模型占46%;此前一个周六,开放权重模型份额曾达到62%。 DeepSeek V4 Flash 是这轮变化的主要推动者:更新权重显著提升了智能体任务表现,同时保留了面向效率和成本控制的定位。
代币流量占比不等于平台收入占比。Vercel此前数据显示,开放权重模型处理了29%的代币,但对应支出不足4%。