| Token 类型 | 当前价格 | 新非高峰价(预估) | 新高峰价(预估) |
|---|---|---|---|
| 输入(未命中缓存) | $0.435 | ~$0.44–$0.49 | ~$0.87–$0.98 |
| 输出 | $0.87 | $1.98 | $3.96 |
| Token 类型 | 当前价格 | 新非高峰价(预估) | 新高峰价(预估) |
|---|---|---|---|
| 输入(未命中缓存) | $0.14 | ~$0.21 | ~$0.42 |
| 输出 | $0.28 | $0.63 | $1.26 |
命中缓存的输入 Token 仍然极具性价比。例如,V4-Pro 的缓存命中输入价格约为每 1M tokens 仅 $0.004,相比未命中缓存有约 100 倍的折扣,这极大地激励了开发者优化其缓存策略 。
| 规格 | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| 总参数量 | 1.6 万亿 | 2840 亿 |
| 每次激活参数量 | ~490 亿 | ~130 亿 |
| 上下文窗口 | 1,000,000 tokens | 1,000,000 tokens |
| 最大输出长度 | 384,000 tokens | 384,000 tokens |
| 开源协议 | MIT | MIT |
新的价格体系重塑了 DeepSeek 的市场竞争格局。以下是基于标准短上下文 API 价格的对比(每 1M tokens)。
| 模型 | 输入(每 1M) | 输出(每 1M) |
|---|---|---|
| DeepSeek V4-Pro(高峰) | ~$0.87–$0.98 | $3.96 |
| DeepSeek V4-Flash(高峰) | ~$0.42 | $1.26 |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 |
| Anthropic Claude Fable 5 | $10.00 | $50.00 |
在提供的资料中,未找到关于 xAI Grok 4.6 的定价信息,因此无法进行直接比较。
DeepSeek 将涨价的主要原因归结为需求激增导致推理算力承压 。自 2026 年 4 月预览版发布以来,V4 模型获得了大量用户的采用,迅速耗尽了 GPU 算力容量,公司无法再以之前的超低价格维持运营
。
以下几个市场因素共同导致了这一结果:
DeepSeek 此次涨价标志着一个时代的终结:它不再是那个价格碾压所有对手的 API 提供商。在某些维度上,其价格已与 OpenAI 最具性价比的模型看齐,但相比 Anthropic 的高端产品仍有巨大优势。对于开发者而言,峰谷计费、深度的缓存折扣以及 MIT 开源权重这三大因素意味着:最终的 API 费用将更多地取决于工作负载架构的巧妙设计,而不仅仅是模型的原始选择。