| GPT-5.6 Terra(平衡型) | $2.00 | $12.00 | 減 20%(原價 $2.50/$15) |
| GPT-5.6 Sol(旗艦) | $5.00 | $30.00 | 價格不變,但新增 Fast 模式 |
Luna 輸入加輸出嘅總價格降至每百萬代幣 $1.40,成為市場上最便宜嘅前沿級模型之一 。Terra 嘅總價格降至每百萬代幣 $14。Sol 嘅 Fast 模式比標準處理快 2.5 倍,收費為標準價格嘅兩倍,但智能水平不變 。
呢次減價最令人嘖嘖稱奇嘅係背後嘅工程故事。7 月 29 日,OpenAI 透露 GPT-5.6 Sol 自主改寫並優化咗自己嘅生產 GPU 核心程式 — 即係啲喺硬件上真正執行模型嘅底層程式碼 。
透過 Codex 開發環境,GPT-5.6 Sol 連接 OpenAI 內部基礎設施,設計及執行數百個架構實驗,啟動並監控部署,然後根據結果迭代改進 。個模型仲學識咗 Triton 同 Gluon 呢兩種喺 OpenAI 核心程式堆疊中使用嘅程式語言嘅語法 。
OpenAI 公布嘅具體成果係 :
呢啲成果係更廣泛系統優化嘅一部分。報道仲提到 負載平衡全面改革,可以根據地理位置、加速器類型同快取可用性動態分配請求,以及 提示快取(prompt caching),快取有效期約 30 分鐘,使用快取輸入比新鮮輸入平 90% 。
OpenAI 咁快、咁狠嘅減價,反映咗競爭格局喺短短幾星期內已經徹底改變。
Moonshot AI 嘅 Kimi K3(7 月 17 日發布)係一個來自北京初創公司、擁有 2.8 萬億參數嘅開源模型,喺前端編碼基準測試上追平甚至超越咗 GPT-5.6 Sol 同 Anthropic 嘅 Fable 5 。喺 Arena 嘅 Frontend Code 排行榜上,Kimi K3 獲得 1,679 分,壓過 GPT-5.6 Sol 同 Fable 5 。7 月 30 日由 Startrise AI Labs 發布嘅獨立基準測試仲發現,Kimi K3 喺一個前端工程測試中同 Anthropic 嘅 Claude Opus 5 打成平手,但成本只係對方嘅三分之一:跑晒成個測試套件只需 $7.17,而 Opus 5 要 $21.17 。
Kimi K3 成為咗全球最大嘅開源 AI 模型,而且有報道話 Microsoft 考慮將佢引入 Copilot,咁做可以幫 Microsoft 每年慳高達 6 億美元(每代幣成本低 60%)。
Anthropic 喺 7 月 24 日發布咗 Claude Opus 5,輸入價格係每百萬代幣 $5 — 只有 Fable 5 嘅一半 — 而且喺多項基準測試上都贏過 Fable 5 。呢個壓力直接指向 GPT-5.6 Sol 所處嘅高階價格區間。
Google 同 Microsoft 喺 7 月都分別推出咗多個成本效益更高嘅模型,進一步擠壓中階同平價市場 。
呢個競爭環境令 OpenAI 決定將 Luna 定位為「蝕頭賺尾」嘅產品,用嚟搶佔高用量、對價格敏感嘅工作負載,同時保持 Sol 嘅高端差異化優勢 。
呢次減價唔係喺真空之中發生。企業用戶越來越要求對 AI 開支有嚴格嘅預算控制,就好似當年管理雲端開支一樣。
2026 年 7 月 22 日,OpenAI 喺 API 平台上新增 可強制執行嘅每月開支上限 。同 6 月 ChatGPT Enterprise 嘅軟性上限(只係儀表板功能)唔同,7 月 22 日呢個新功能會令 超出預算後嘅 API 請求即時失敗,回傳 HTTP 429 錯誤 。管理員可以喺組織或項目層級設定上限,每個結算周期結束後重置 。
呢個係直接回應一個廣泛嘅痛點。多個消息來源指 Amazon 同其他大型企業正喺內部同客戶層面設限,嚴格審視 AI 開支回報 。採購模式已經轉變:Reuters 報道,注重成本嘅企業而家將 AI 「當雲端咁管理」 — 有獨立預算、設有上限,大規模部署需要 CIO 級別嘅審批 。
OpenAI 嘅硬性開支上限俾咗企業一個安全閥,防止 AI Agent 成本失控,即使公司同時提供更低嘅每代幣價格。訊息好清楚:「AI 使費無上限」嘅時代已經終結。
對使用 OpenAI API 嘅開發者同企業嚟講,短期影響係正面嘅:
更廣泛嘅教訓係:AI 價格戰係真嘅,而且正在加速,背後嘅驅動力唔單止係競爭壓力,仲有工程效率嘅突破 — 包括前所未見嘅「模型自己優化自己生產程式碼」呢種情況。隨著呢啲自我優化技術成熟,以及開源模型持續追近能力差距,企業應該預期行業價格會進一步下跌。