Ultrafast è alimentato dai chip wafer-scale Cerebras (sistemi Cerebras CS-3) . Cerebras e OpenAI hanno annunciato congiuntamente la partnership, con Cerebras che fornisce l'hardware di inferenza a bassa latenza che rende possibile l'accelerazione
. Non si tratta di un nuovo modello: Ultrafast esegue l'attuale GPT-5.6 Sol, presentato in anteprima a giugno 2026 e ampiamente disponibile da luglio, su infrastruttura Cerebras specializzata
.
OpenAI si rivolge a flussi di lavoro enterprise dove ogni millisecondo conta . Durante l'anteprima, i clienti stanno testando Ultrafast in cinque aree principali
:
OpenAI sta inoltre applicando Ultrafast a flussi di lavoro di ricerca che coinvolgono ricerche di conoscenza, query di dati, strumenti connessi e sintesi di informazioni .
Ultrafast è in anteprima limitata (su lista d'attesa) per clienti API selezionati a partire dal 13-14 agosto 2026 . OpenAI dichiara che l'accesso sarà esteso a più aziende man mano che la capacità Cerebras crescerà
. Il prezzo non è stato ancora comunicato — si sa solo che sarà un tier API premium
. I prezzi API standard di GPT-5.6 rimangono: Sol $5/$30, Terra $2/$12 e Luna $0,20/$1,20 per milione di token di input/output
.