GPT 5.6 Sol短上下文输入价格从每百万Token 5美元降至4美元,输出价格从30美元降至20美元;长上下文价格为输入8美元、输出30美元。[17] Sol此次输入降价20%、输出降价约33%,幅度低于此前Luna降价80%和Terra降价20%的调整;OpenAI还为Sol提供最高约2.5倍速度的Fast模式,但价格为标准处理的两倍。[18][26] OpenRouter页面显示的Sol价格为每百万输入Token 2美元、输出Token 10美元,约为OpenAI新直连短上下文价格的一半,但这属于特定路由价格,不应直接视为OpenAI的统一官方价。[39]
研究答案

Create a landscape editorial hero image for this Studio Global article: What changes did OpenAI make to GPT 5.6 Sol’s API and credit pricing, how does the reduction compare with the earlier GPT 5.6 Luna and Terra. Article summary: OpenAI has cut direct GPT‑5.6 Sol API pricing to $4/M short context input tokens and $20/M output tokens, from the earlier $5/M and $30/M—20% lower on input and about 33% lower on output.. Topic tags: general web, openai, ai, productivity, code. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thum
OpenAI再次下调GPT-5.6 Sol的API及相关信用额度价格。按照开发者定价页面,Sol短上下文的输入价格已从每百万Token 5美元降至4美元,输出价格从30美元降至20美元,分别下降20%和约33%。长上下文价格则为输入8美元、输出30美元。
这次调整的有效期至少到2026年11月21日,且影响范围主要是API以及符合条件的信用额度计划;Pro、Plus和Business订阅价格并未因此改变。
| 模型 | 此前短上下文价格(输入/输出,每百万Token) | 目前价格 | 降幅或变化 |
|---|---|---|---|
| GPT-5.6 Sol | 5美元 / 30美元 | 4美元 / 20美元 | 输入降20%,输出降约33% |
| GPT-5.6 Terra | 2.50美元 / 15美元 | 2美元 / 12美元 | 降20% |
| GPT-5.6 Luna | 1美元 / 6美元 | 0.20美元 / 1.20美元 | 降80% |
Luna和Terra的降价发生在7月30日。Luna主打高并发、低延迟和低成本场景,降价幅度最大;Terra则定位为兼顾推理能力、性能与成本的生产级模型。
Sol的调整相对温和,但绝对降幅仍然可观,尤其是输出Token价格从30美元降至20美元。对于需要生成大量代码、长篇分析或多轮代理输出的应用,输出成本往往是账单中的重要部分,因此这一变化可能比输入端降价更直接地影响总成本。
OpenAI此前还为Sol推出Fast模式:在不改变模型智能水平的前提下,处理速度最高可达到标准处理的约2.5倍,但价格为标准价格的两倍。这意味着Sol仍然不是单纯的“便宜旗舰”,而是通过标准版和高速版分别满足成本敏感与延迟敏感的客户。
Sol依旧是这一产品家族的旗舰型号,价格最高,也承担OpenAI展示前沿能力和高端吞吐能力的角色。Terra更适合需要平衡性能与成本的常规生产工作负载,Luna则面向分类、摘要、路由等高数量、低延迟任务。
因此,Sol的定位并不只是“最贵的型号”。它更像是面向复杂推理、关键任务和对性能要求较高的应用的顶级选项;Fast模式则把同一模型的速度作为额外付费能力出售。随着基础推理成本下降,模型厂商正在把竞争从单一的能力排名扩展到价格、吞吐、延迟和服务等级的组合。
OpenRouter目前展示的GPT-5.6 Sol价格为每百万输入Token 2美元、输出Token 10美元,约为OpenAI新直连短上下文价格的一半。
不过,企业不应仅凭这个数字就认定OpenRouter提供了长期、普遍适用的官方降价。聚合平台的价格可能取决于具体供应商路由、促销活动、是否使用平台自有额度、缓存规则以及服务条款。实际采购时,还需要核对:
换言之,OpenRouter可能是有吸引力的采购渠道,但“单价更低”并不自动等于“总拥有成本更低”。
AWS已将GPT-5.6 Sol、Terra和Luna扩展到bedrock-runtime端点,并支持Responses、Converse和Chat Completions API。同时,Bedrock为这些模型加入了地理跨区域(Geo cross-Region)和全球跨区域(Global cross-Region)推理。
In-Region模式会在用户选定的AWS区域内处理请求。最初,Sol可在美国东部(弗吉尼亚北部)和美国东部(俄亥俄)使用;Terra和Luna还支持美国西部(俄勒冈)。
这种模式适合对单一区域处理、合规边界或数据驻留有严格要求的组织,但可用容量也会受到单一区域限制。
Geo模式允许Bedrock在预先定义的地理范围内路由请求,例如美国、欧盟、日本或澳大利亚,而不是把请求固定在一个AWS区域。这样既能扩大可用容量,又能让数据处理保持在规定的地理范围内,适合按国家或区域设置数据驻留边界的企业。
Global模式通常通过带有global.前缀的推理配置文件进行调用。Bedrock会根据实时容量,将请求调度到模型已部署的任一受支持商业AWS区域,从而获得更大的容量池和更高的高峰期吞吐能力。
代价是,全球模式不保证请求始终留在某个指定国家或地理范围内。因此,若业务受到数据主权、行业监管或内部安全政策约束,就不能只因为全球模式价格更低或容量更大而直接采用它。
AWS文档显示,Sol短上下文价格档位对应272K Token;长上下文窗口最高可达100万Token。GPT-5.6 Sol、Terra和Luna均支持文本与图像输入、文本输出、提示缓存,以及最长100万Token的上下文窗口。
在短上下文档位下,Sol的Bedrock价格还会随路由方式变化:Global跨区域价格为每百万输入Token 5美元、输出Token 30美元;In-Region和Geo跨区域价格为输入5.50美元、输出33美元。长上下文Global价格为输入10美元、输出45美元;In-Region和Geo价格为输入11美元、输出49.50美元。
AWS还列出Sol每个受支持区域每分钟1000万Token的跨区域推理配额。该配额计算请求中的输入和输出Token总量,并适用于相关调用方式。实际价值在于,企业可以让平台自动寻找可用容量,而不必自行维护单一区域的故障转移和容量切换逻辑。
GPT-5.6的价格变化体现了前沿模型市场的一个明显趋势:推理效率正在越来越多地转化为更低的客户价格和更细分的速度等级,而不只是成为模型厂商扩大利润的空间。OpenAI在此前公告中将Luna、Terra的降价和Sol性能提升归因于价格性能比改善。
对开发者而言,模型选择从“哪个模型最强”变成了更复杂的组合决策:哪些请求必须交给Sol,哪些可以交给Terra或Luna;是否值得为Fast模式支付溢价;缓存命中率能否降低输入成本;以及供应商的路由和容量是否足够稳定。
对企业而言,Bedrock和聚合平台的价值也不只在Token单价。AWS原生账单、IAM权限管理、区域与地理范围选择、跨区域容量调度和故障缓解,都可能降低运营复杂度。相应的风险是,跨区域路由会改变数据处理边界,而第三方聚合平台则会增加合同、数据处理和版本一致性方面的审查工作。
因此,更稳妥的采购方式不是简单选择最便宜的端点,而是分别测试OpenAI直连、Amazon Bedrock和聚合平台,比较完整的单位任务成本、延迟、吞吐、缓存表现、限流策略、数据处理条款、模型版本一致性,以及自动跨区域路由是否符合合规要求。前沿AI的竞争正在从“模型能力竞赛”转向“能力、成本与基础设施选择权”的综合竞争。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
GPT 5.6 Sol短上下文输入价格从每百万Token 5美元降至4美元,输出价格从30美元降至20美元;长上下文价格为输入8美元、输出30美元。[17]
GPT 5.6 Sol短上下文输入价格从每百万Token 5美元降至4美元,输出价格从30美元降至20美元;长上下文价格为输入8美元、输出30美元。[17] Sol此次输入降价20%、输出降价约33%,幅度低于此前Luna降价80%和Terra降价20%的调整;OpenAI还为Sol提供最高约2.5倍速度的Fast模式,但价格为标准处理的两倍。[18][26]
OpenRouter页面显示的Sol价格为每百万输入Token 2美元、输出Token 10美元,约为OpenAI新直连短上下文价格的一半,但这属于特定路由价格,不应直接视为OpenAI的统一官方价。[39]