O Ultrafast é viabilizado pelos chips wafer-scale da Cerebras (sistemas Cerebras CS-3) . A parceria entre as duas empresas foi anunciada em conjunto, com a Cerebras fornecendo o hardware de inferência de baixa latência que torna o salto de velocidade possível
. Não se trata de um novo modelo — o Ultrafast roda o já existente GPT-5.6 Sol (apresentado em junho de 2026 e amplamente disponível desde julho) em uma infraestrutura especializada da Cerebras
.
A OpenAI está direcionando o Ultrafast para fluxos de trabalho empresariais onde cada milissegundo importa . Durante o preview, clientes estão testando a novidade em cinco áreas principais
:
A OpenAI também está aplicando o Ultrafast a fluxos de pesquisa que envolvem buscas de conhecimento, consultas a dados, ferramentas conectadas e síntese de informações .
O Ultrafast está em preview limitado (baseado em lista de espera) para clientes de API selecionados desde 13–14 de agosto de 2026 . A OpenAI afirma que o acesso será ampliado para mais empresas à medida que a capacidade da Cerebras crescer
. O preço não foi divulgado — apenas que será uma camada premium da API
. Os preços padrão da API do GPT-5.6 permanecem: Sol US$ 5/US$ 30, Terra US$ 2/US$ 12 e Luna US$ 0,20/US$ 1,20 por milhão de tokens de entrada/saída
.