OpenAI于2026年8月13日预览Ultrafast模式,基于Cerebras CS 3晶圆级芯片,GPT 5.6 Sol推理速度最高可达标准处理的14倍,输出吞吐量达750 token/秒。 该模式并非新模型,而是现有GPT 5.6 Sol的加速服务层,首批应用场景包括故障应急响应、客户支持、金融分析、代码开发和电商等对延迟敏感的企业工作流。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is OpenAI's new "Ultrafast" mode for GPT-5.6 Sol, how fast is it compared to standard processing, what token throughput does it achieve. Article summary: Here is the full breakdown of OpenAI's Ultrafast mode for GPT-5.6 Sol:. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
2026年8月13日,OpenAI预览了名为"Ultrafast"的全新API服务层,该层可让旗下最强模型GPT-5.6 Sol以大幅加速的推理速度运行 。该服务层由Cerebras晶圆级芯片(Cerebras CS-3系统)驱动,旨在消除企业应用中模型质量与响应速度之间的传统取舍
。
OpenAI表示,Ultrafast模式的处理速度最高可达标准处理层的14倍 。该层可实现每秒高达750个输出token,大约是标准GPT-5.6 Sol推理吞吐量的14倍
。对于延迟敏感的任务,响应时间从数秒缩短至近乎实时
。Cerebras称,这一速度提升并未牺牲模型质量,Sol Ultrafast在保持业界顶尖性能的同时实现了更高速度
。
Ultrafast由Cerebras晶圆级芯片(Cerebras CS-3系统)提供算力支撑 。Cerebras与OpenAI联合发布了此次合作,Cerebras负责提供实现加速所需的低延迟推理硬件
。需要注意的是,Ultrafast并非新模型——它运行的是已在2026年6月预览、7月全面上线的GPT-5.6 Sol,只不过将其部署在专用Cerebras基础设施上
。
OpenAI瞄准的是那些毫秒级延迟都至关重要的企业工作流 。预览期间,客户主要在以下五大垂直领域测试Ultrafast
:
此外,OpenAI还将Ultrafast应用于涉及知识搜索、数据查询、工具连接及信息整合的研究工作流 。
截至2026年8月13日至14日,Ultrafast处于有限预览阶段,仅面向少数受邀API客户开放(需加入等待名单)。OpenAI表示,随着Cerebras产能提升,访问权限将逐步扩大至更多企业
。定价尚未公布——仅知它将是一个高级API层
。标准版GPT-5.6 API价格保持不变:Sol $5/$30,Terra $2/$12,Luna $0.20/$1.20(每百万输入/输出token)
。
此次有限预览体现了OpenAI在扩展全新基础设施合作关系时采取的谨慎态度。随着Cerebras系统容量的增长,预计会有更广泛的开放访问,但官方尚未公布具体时间表 。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
OpenAI于2026年8月13日预览Ultrafast模式,基于Cerebras CS 3晶圆级芯片,GPT 5.6 Sol推理速度最高可达标准处理的14倍,输出吞吐量达750 token/秒。
OpenAI于2026年8月13日预览Ultrafast模式,基于Cerebras CS 3晶圆级芯片,GPT 5.6 Sol推理速度最高可达标准处理的14倍,输出吞吐量达750 token/秒。 该模式并非新模型,而是现有GPT 5.6 Sol的加速服务层,首批应用场景包括故障应急响应、客户支持、金融分析、代码开发和电商等对延迟敏感的企业工作流。
Ultrafast目前仅通过API向受邀客户开放有限预览,定价尚未公布,OpenAI表示将随Cerebras产能增长逐步扩大访问权限。