OpenAI 喺 2026 年 6 月 26 號發布 GPT 5.6 系列,分為旗艦版 Sol、平衡版 Terra 同經濟版 Luna,但因為美國政府要求,暫時只開放畀大約 20 間獲批嘅合作機構。 旗艦型號 GPT 5.6 Sol Ultra 喺 Terminal Bench 2.1 測試攞到 91.9%,贏過 Claude Mythos 5 嘅 88% 同 GPT 5.5 嘅 83.4%。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What new mathematical discovery did OpenAI's GPT-5.6 achieve, what are the model's benchmark scor. Article summary: ## What new mathematical discovery did OpenAI's GPT-5.6 achieve?. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026 年 6 月 26 號,OpenAI 發布咗佢哋史上最強嘅 AI 模型系列——GPT-5.6 Sol、Terra 同 Luna。但同之前嘅發布好唔同,今次幾乎冇乜人可以用到。應特朗普政府嘅明確要求,使用權限只限於大約 20 間獲政府批准嘅機構,白宮官員仲要逐間審批合作夥伴HTA。以下係關於 GPT-5.6 Benchmark 表現、定價,以及呢次前所未有嘅「政府閘門」發布機制嘅全面分析。
暫時冇相關報告。 雖然外界有好多傳聞同猜測,但係現有嘅資料都冇提到 GPT-5.6 發現咗任何新嘅數學定理或者證明。所有討論都集中喺模型喺編程、網絡安全、生物學同埋智能體任務(agentic tasks)上嘅 Benchmark 表現AO。冇任何來源提及具體嘅數學發現。
呢個 Benchmark 專門測試模型嘅規劃、工具使用同埋命令列(command-line)嘅智能體能力,被形容為「殘酷測試」,考驗模型喺終端環境入面自主操作嘅能力Y。具體分數如下:
| 型號 | Terminal-Bench 2.1 分數 |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% BI |
| GPT-5.6 Sol | 88.8% B |
| Claude Mythos 5 | 88.0% I |
| GPT-5.5 | 83.4% BI |
Sol Ultra 嘅 91.9% 係一個重大突破,比 Anthropic 最好嘅模型高出大約 4 個百分點,仲比 GPT-5.5 超出超過 8 個百分點BI。
OpenAI 將三個 GPT-5.6 型號嘅網絡安全同生物風險都評為「高」,但未達到「極高」級別A。
| 型號 | 輸入(美元/百萬 tokens) | 輸出(美元/百萬 tokens) | 定位 |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | 旗艦——複雜推理、編程、網絡安全、長期智能體任務 |
| GPT-5.6 Terra | $2.50 | $15.00 | 平衡——效能同 GPT-5.5 差不多,但價錢平一半 |
| GPT-5.6 Luna | $1.00 | $6.00 | 大量使用——最快、最抵用,適合分類、提取、路由 |
OpenAI 仲為 GPT-5.6 推出咗 prompt 緩存功能。寫入緩存嘅費用係模型未緩存輸入價格嘅 1.25 倍,而讀取緩存就會有 90% 嘅折扣。GPT-5.6 支援明確嘅緩存中斷點,同埋最少 30 分鐘嘅緩存壽命H。
主要原因:美國政府直接干預。 特朗普政府明確要求 OpenAI 喺發布前限制使用權限,理由係國家安全考慮TAK。白宮官員逐間審批嗰大約 20 間獲批嘅合作夥伴機構AI。
政府認為 GPT-5.6 嘅能力同 Anthropic 嘅 Claude Mythos 差唔多級數。而 Claude Mythos 嘅前身 Claude Fable 5,喺 2026 年 6 月 12 號已經因為美國商務部嘅出口管制規則而被強制全球暫停使用A。今次 GPT-5.6 嘅限制正係源自同一個政策框架。
OpenAI 公開表示,呢種「政府閘門」機制「令最頂尖嘅工具無法到達用戶、開發者、企業、網絡防禦者同全球合作夥伴手中」A。
OpenAI 話佢哋「計劃盡快擴大使用範圍」,但暫時未有正式嘅全面開放日期H。Sam Altman 就話預計「幾星期內」會有更廣泛嘅使用權限A。公司嘅系統卡(system card)寫住:「我哋相信廣泛使用,並計劃喺未來幾星期內令 GPT-5.6 Sol、Terra 同 Luna 全面開放」D。
而家嚟講,OpenAI 史上最強大嘅 AI 模型,只有華盛頓批准嘅人先用得到。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI 喺 2026 年 6 月 26 號發布 GPT 5.6 系列,分為旗艦版 Sol、平衡版 Terra 同經濟版 Luna,但因為美國政府要求,暫時只開放畀大約 20 間獲批嘅合作機構。
OpenAI 喺 2026 年 6 月 26 號發布 GPT 5.6 系列,分為旗艦版 Sol、平衡版 Terra 同經濟版 Luna,但因為美國政府要求,暫時只開放畀大約 20 間獲批嘅合作機構。 旗艦型號 GPT 5.6 Sol Ultra 喺 Terminal Bench 2.1 測試攞到 91.9%,贏過 Claude Mythos 5 嘅 88% 同 GPT 5.5 嘅 83.4%。
定價按每百萬個 token 計算:Luna 最平(輸入 $1/輸出 $6),Terra 中等($2.50/$15),Sol 最貴($5/$30)。Terra 嘅效能同 GPT 5.5 差唔多,但成本平一半。