OpenRouter 目前顯示 GPT-5.6 Sol 的價格為每百萬輸入 tokens 2 美元、輸出 10 美元,即係 OpenAI 新列出的短上下文直連價一半。
對大量使用者嚟講,呢個差距可以直接影響採購決定。不過,OpenRouter 屬於模型路由平台,實際價格可能受供應商路線、促銷安排、快取、流量類型及服務條款影響,因此應該視為特定路由上的現行報價,而唔係 OpenAI 對所有渠道作出的永久統一減價。
比較價格時,亦要確認以下幾點:
Amazon Bedrock 就將 GPT-5.6 Sol、Terra 同 Luna 擴展至 bedrock-runtime endpoint,支援 Responses API、Converse API 同 Chat Completions API,同時加入地理跨區域及全球跨區域推理。
In-Region 模式會將請求留喺使用者指定的 AWS Region,適合有嚴格資料管轄或合規要求的工作負載。初期 Sol 可用於 US East(N. Virginia)及 US East(Ohio);Terra 同 Luna 另外亦支援 US West(Oregon)。
Geo cross-Region inference 會喺預先定義的地理範圍內安排運算,例如美國、歐盟、日本或澳洲,而唔係鎖死單一 Region。企業可以用較大的容量池提升吞吐量,同時維持資料留喺指定地理範圍內,適合有地域資料留存要求但唔一定要鎖定單一機房的情況。
Global inference profile 會以 global. 開頭,例如 global.openai.gpt-5.6-sol。Bedrock 可以根據即時容量,將請求派往任何支援該模型的商用 AWS Region,容量池最大,亦較有利於應付需求高峰。
AWS 文件顯示,Sol 在 272K 短上下文價格層級下,Global cross-Region 的輸入價為每百萬 tokens 5 美元、輸出 30 美元;In-Region 及 Geo cross-Region 則為 5.50 美元輸入、33 美元輸出。
如果使用 1M 長上下文,Global cross-Region 價格為 10 美元輸入、45 美元輸出;In-Region 及 Geo cross-Region 則為 11 美元輸入、49.50 美元輸出。
容量方面,AWS 為 GPT-5.6 Sol 列出每個支援 Region 每分鐘 1,000 萬 tokens 的跨區域模型推理配額。配額計算每次請求的輸入及輸出 tokens 總和,涵蓋 Converse、ConverseStream、InvokeModel 及 InvokeModelWithResponseStream 等呼叫方式。
整個 GPT-5.6 系列在 Bedrock 支援文字及圖片輸入、文字輸出、prompt caching,並提供最高 100 萬 tokens 的上下文窗口;AWS 同時以 272K 作為短上下文定價層級。
呢一連串改動反映 2026 年前沿模型競爭,已經由單純鬥模型能力,轉向鬥 每次推理成本、速度、容量同採購彈性。OpenAI 先大幅壓低 Luna 同 Terra 的價格,再調低旗艦 Sol;而聚合平台亦可能以特定路由或限時優惠提供更低價格。
對企業而言,Bedrock 的價值亦唔止係 token 價格。AWS 原生計費、IAM 權限控制、單區域或地理範圍路由,以及跨區域調度所帶來的容量與故障應變能力,都可能比表面上的每百萬 tokens 報價更重要。
所以,最穩陣的採購方法唔係盲目揀最平 endpoint,而係先用實際工作負載測試直連 OpenAI、Amazon Bedrock 同聚合平台,再逐項核對合約、資料處理方式、模型版本、速率限制、快取行為、延遲表現,以及 Global routing 是否符合合規要求。對需要嚴格地域限制的資料,Global 模式的容量優勢,未必值得放棄資料留存控制。