OpenAI于2026年6月26日发布GPT 5.6家族,包括旗舰型Sol、均衡型Terra和经济型Luna,但访问权限仅限约20家美国政府批准的机构。 定价按每百万token计算:Luna(输入$1/输出$6)到Sol(输入$5/输出$30),Terra性能与GPT 5.5相当但成本减半。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What new mathematical discovery did OpenAI's GPT-5.6 achieve, what are the model's benchmark scor. Article summary: ## What new mathematical discovery did OpenAI's GPT-5.6 achieve?. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026年6月26日,OpenAI发布了迄今最强大的AI模型系列——GPT-5.6 Sol、Terra和Luna。但与以往发布不同,这次几乎没人能用上。应特朗普政府的明确要求,访问权限被限制在大约20家政府批准的机构,白宫官员亲自逐家审核了合作伙伴HTA。以下是关于GPT-5.6基准测试性能、定价,以及发布背后史无前例的政府管控的全部已知信息。
没有相关报道。 尽管有各种传闻和猜测,但现有资料中没有任何一个描述了GPT-5.6具体的数学发现、定理或证明。该模型的能力完全体现在编码、网络安全、生物学和智能体任务的基准测试表现上AO。没有来源提及任何新颖的数学发现。
这项基准测试评估模型的规划、工具使用和命令行智能体能力——对模型在终端环境中自主运行能力的"残酷考验"Y。报告的成绩如下:
| 模型 | Terminal-Bench 2.1 得分 |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% BI |
| GPT-5.6 Sol | 88.8% B |
| Claude Mythos 5 | 88.0% I |
| GPT-5.5 | 83.4% BI |
Sol Ultra 的91.9%是一个重大飞跃——比Anthropic最强模型高出约4个百分点,比GPT-5.5高出超过8个百分点BI。
OpenAI将GPT-5.6所有三个模型在网络安全和生物风险方面均评定为**"高风险",但均未达到"临界风险"**阈值A。
| 模型 | 输入(美元/每百万token) | 输出(美元/每百万token) | 定位 |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | 旗舰型——复杂推理、编码、网络安全、长周期智能体任务 |
| GPT-5.6 Terra | $2.50 | $15.00 | 均衡型——性能与GPT-5.5相当,成本减半 |
| GPT-5.6 Luna | $1.00 | $6.00 | 经济型——适用于分类、提取、路由的最快、最具性价比方案 |
OpenAI还为GPT-5.6引入了提示缓存功能。缓存写入按模型未缓存输入费率的1.25倍计费,而缓存读取则可享受缓存输入token的90%折扣。GPT-5.6支持显式缓存断点以及最少30分钟的缓存生命周期H。
主要原因:美国政府直接干预。 特朗普政府明确要求OpenAI在发布前限制访问权限,理由是国家安全担忧TAK。白宫官员逐一审核并批准了大约20家合作伙伴机构AI。
特朗普政府认为GPT-5.6具备与Anthropic的Claude Mythos相当的"Mythos级"能力——其前身Claude Fable 5已于2026年6月12日被美国商务部以出口管制为由在全球范围内强制暂停A。对GPT-5.6的限制源于同一政策框架。
OpenAI公开表示,这种政府管控"将最好的工具与需要它们的用户、开发者、企业、网络防御者和全球合作伙伴隔离开来"A。
OpenAI表示其"计划尽快扩大可用范围",但尚未公布通用的发布日期H。Sam Altman表示,他预计"数周内"将实现更广泛的访问A。公司的系统卡中写道:"我们坚信广泛访问的重要性,并计划在未来几周内让GPT-5.6 Sol、Terra和Luna普遍可用"D。
目前,OpenAI有史以来发布的最强大AI模型,只有华盛顿特区批准的那些机构才能使用。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
OpenAI于2026年6月26日发布GPT 5.6家族,包括旗舰型Sol、均衡型Terra和经济型Luna,但访问权限仅限约20家美国政府批准的机构。
OpenAI于2026年6月26日发布GPT 5.6家族,包括旗舰型Sol、均衡型Terra和经济型Luna,但访问权限仅限约20家美国政府批准的机构。 定价按每百万token计算:Luna(输入$1/输出$6)到Sol(输入$5/输出$30),Terra性能与GPT 5.5相当但成本减半。
Sol Ultra在Terminal Bench 2.1基准测试中得分91.9%,超越Claude Mythos 5(88%)和GPT 5.5(83.4%)。OpenAI表示将在数周内扩大访问范围。