Ultrafast wordt mogelijk gemaakt door Cerebras wafer-schaal chips (Cerebras CS-3-systemen) . Cerebras en OpenAI kondigden het partnerschap gezamenlijk aan; Cerebras levert de inferentiehardware met lage latentie die de versnelling mogelijk maakt
. Het is geen nieuw model — Ultrafast draait het bestaande GPT-5.6 Sol, dat in juni 2026 werd gepreviewd en sinds juli breed beschikbaar is, op gespecialiseerde Cerebras-infrastructuur
.
OpenAI richt zich op bedrijfswerkstromen waar elke milliseconde telt . Tijdens de preview testen klanten Ultrafast in vijf primaire sectoren
:
OpenAI past Ultrafast ook toe op onderzoekwerkstromen met kenniszoekopdrachten, data queries, gekoppelde tools en informatiesynthese .
Ultrafast is in beperkte preview (op wachtlijstbasis) voor geselecteerde API-klanten sinds 13–14 augustus 2026 . OpenAI zegt dat de toegang wordt uitgebreid naarmate de Cerebras-capaciteit groeit
. Prijzen zijn niet bekendgemaakt — alleen dat het een premium API-laag wordt
. De standaard GPT-5.6 API-prijzen blijven: Sol $5/$30, Terra $2/$12 en Luna $0,20/$1,20 per miljoen input-/outputtokens
.