GPT-5.6 Luna——该系列中速度最快、价格最低的模型——价格暴降 80% 。其新 API 定价如下 :
| 指标 | 原价(每百万tokens) | 新价(每百万tokens) |
|---|---|---|
| 输入 | $1.00 | $0.20 |
| 缓存输入 | $0.25 | $0.10 |
| 输出 | $6.00 | $1.20 |
这意味着,Luna 的综合输入加输出价格降至每百万 tokens $1.40 。作为对比,中端模型 GPT-5.6 Terra 降价 20%,输入降至每百万 tokens $2.00,输出降至 $12.00(原价分别为 $2.50 和 $15.00)。旗舰模型 GPT-5.6 Sol 的价格不变,仍为输入 $5.00 / 输出 $30.00(每百万 tokens)。
新价格于 2026年7月30日立即生效,适用于标准 API 层级 。
OpenAI 为此次激进降价给出了两个相互关联的解释 。
OpenAI 在官方博客中表示,此次降价得益于模型各个层面的改进,包括更优的代码效率和系统优化,使其能够以更低的成本提供“更高的智能” 。OpenAI 将此定义为“推进性价比的边界” 。值得注意的是,效率突破部分归功于 GPT-5.6 Sol 自身——它自主重写了生产代码内核,将模型服务成本降低了 20% 。额外的内核级工作使端到端服务成本再降 20%,而相关实验将 token 生成效率提升了超过 15% 。
多家媒体报道指出,此次定价调整发生在企业对 AI 支出日益审慎以及来自中国开源模型等更廉价替代品的竞争日益激烈的背景之下 。CNBC 报道称,OpenAI 正“面临压力,需要迎合对成本更为敏感的客户群”,许多企业因无法清晰看到投资回报率,对于部署昂贵的 AI 模型犹豫不决 。Axios 指出,“更便宜的中国开源模型也增加了 OpenAI 和 Anthropic 的压力,他们需要证明自己模型的更高价格是合理的” 。路透社也评论称,降价“部分得益于 GPT-5.6 的效率提升”,但也反映了“企业对 AI 支出的审查” 。
CEO 山姆·奥特曼(Sam Altman)在 X(原 Twitter)上宣布了上述变化,他写道:“我们希望在各个层面都能提供最佳的价格/智能平衡” 。
对于使用 OpenAI API 的开发者和企业来说,Luna 80% 的降价使其成为处理高负载工作负载时最具成本效益的选择之一。Luna 被定位为 GPT-5.6 系列中速度最快、价格最低的模型,非常适合需要速度和效率的任务 。此次降价也反映在 ChatGPT Work 和 Codex 付费订阅的用量计算方式上,有效地让企业订阅用户可以在不增加支出的情况下完成更多 AI 工作 。
总之,OpenAI 2026 年 7 月 30 日的定价更新,是其在真正的工程进步和日益激烈的 AI 竞争压力现实双重驱动下,对其 API 成本进行的快速重新校准。