OpenAI 嘅 Ultrafast 模式令 GPT 5.6 Sol 推理速度快 14 倍,每秒輸出 750 個 Token,靠 Cerebras CS 3 晶圓級晶片推動,8 月開始有限度預覽。 針對企業場景:事故應變、客戶服務、金融分析、程式開發同電子商務,啲 latency 好重要嘅地方。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is OpenAI's new "Ultrafast" mode for GPT-5.6 Sol, how fast is it compared to standard processing, what token throughput does it achieve. Article summary: Here is the full breakdown of OpenAI's Ultrafast mode for GPT-5.6 Sol:. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026 年 8 月 13 日,OpenAI 預覽咗 Ultrafast,一個全新嘅 API 服務層,令最強模型 GPT-5.6 Sol 嘅推理速度快到嚇親人 。呢個服務層由 Cerebras 晶圓級晶片(Cerebras CS-3 系統)推動,目標係打破以往企業應用要喺模型質素同反應速度之間二選一嘅困局
。
OpenAI 話,Ultrafast 比標準處理層 快 14 倍 。呢個服務層可以做到 每秒輸出 750 個 Token,大約係標準 GPT-5.6 Sol 推理速度嘅 14 倍
。對於 latency 敏感嘅任務,反應時間由幾秒鐘降到近乎實時
。Cerebras 強調,呢個加速完全唔影響質素,即係 Sol Ultrafast 喺快咗好多嘅情況下,仍然保持到頂尖嘅表現
。
Ultrafast 嘅心臟係 Cerebras 晶圓級晶片(Cerebras CS-3 系統) 。Cerebras 同 OpenAI 一齊公布呢個合作,Cerebras 提供低延遲嘅推理硬件,先至做到咁誇張嘅加速
。呢個唔係新模型——Ultrafast 係將 2026 年 6 月預覽、7 月全面推出嘅 GPT-5.6 Sol,放喺 Cerebras 嘅專用基建上嚟行
。
OpenAI 嘅目標係做啲每毫秒都咁重要嘅企業工作流程 。預覽期間,客戶正喺五個主要行業測試 Ultrafast
:
OpenAI 仲將 Ultrafast 用喺研究工作中,包括知識搜索、數據查詢、連接工具同資訊整合 。
Ultrafast 而家係 有限度預覽(要等候補名單),只開放畀指定嘅 API 客戶(截至 2026 年 8 月 13-14 日)。OpenAI 話會隨著 Cerebras 嘅產能增加,逐步開放畀更多企業
。定價方面就未公布——淨係話會係一個高級 API 層
。標準 GPT-5.6 API 價格不變:Sol 每百萬輸入/輸出 Token 收 $5/$30,Terra 收 $2/$12,Luna 收 $0.20/$1.20
。
呢個有限度預覽反映咗 OpenAI 對新基建夥伴擴張嘅謹慎態度。預計 Cerebras 系統產能提升後,會有更廣泛嘅開放,但確實時間表就未公布 。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI 嘅 Ultrafast 模式令 GPT 5.6 Sol 推理速度快 14 倍,每秒輸出 750 個 Token,靠 Cerebras CS 3 晶圓級晶片推動,8 月開始有限度預覽。
OpenAI 嘅 Ultrafast 模式令 GPT 5.6 Sol 推理速度快 14 倍,每秒輸出 750 個 Token,靠 Cerebras CS 3 晶圓級晶片推動,8 月開始有限度預覽。 針對企業場景:事故應變、客戶服務、金融分析、程式開發同電子商務,啲 latency 好重要嘅地方。
呢個係現有 GPT 5.6 Sol 模型嘅加速層,唔係新模型,質素唔會降低,但暫時只開放畀指定 API 客戶,要等候補名單。