Isso torna plausível a leitura de que Spud seja um codinome interno em desenvolvimento. Mas não transforma o nome em lançamento público. A página de modelos da API da OpenAI citada neste levantamento lista gpt-5.4, gpt-5.4-mini e gpt-5.4-nano, sem confirmar Spud ou GPT-5.5 como modelos disponíveis.
A formulação mais segura, portanto, é: Spud é um codinome de modelo da OpenAI reportado pela imprensa; seu nome público, suas capacidades, seus benchmarks e sua data de lançamento ainda não foram confirmados por documentação oficial ou testes reproduzíveis.
Em vazamentos de IA, volume de compartilhamento não é o mesmo que evidência. Para separar rumor de fato verificável, vale procurar por quatro tipos de material:
Por esse critério, a existência e o estágio de treinamento do Spud têm algum lastro jornalístico. Já benchmarks, demos, data de lançamento e o nome GPT-5.5 ainda não passam pelo mesmo filtro.
| Alegação que circula | O que dá para verificar | Status |
|---|---|---|
| A OpenAI tem um novo modelo com codinome “Spud” | O The Information menciona a preparação de um modelo “Spud”; o The Decoder relata que a OpenAI teria concluído o pré-treinamento de um modelo com esse codinome. | Parcialmente corroborado por imprensa, mas não confirmado oficialmente |
| Spud já foi lançado, ou sairá como GPT-5.5 | A página de modelos da API citada no levantamento lista a família gpt-5.4, não Spud ou GPT-5.5. | Não verificado |
| Spud teria benchmark próximo ou superior ao Claude Mythos | Os 77,80% citados são do Claude Mythos Preview no SWE-bench Pro; os 57,70% são do GPT-5.4. A referência ao Spud aparece em tom de expectativa, não como placar próprio. | Não verificado |
| O SWE-bench já teria resultado do Spud | O SWE-bench mantém leaderboards públicos, mas o material analisado não traz uma submissão, página de resultado ou eval card verificável do Spud. | Não verificado |
| Demos de mundos 3D, SVG, sites e jogos provam a capacidade do Spud | A Geeky Gadgets apresenta o material como relato “according to Universe of AI” e observa que métricas oficiais de desempenho não foram divulgadas. | Relato de segunda mão; não serve como prova de capacidade |
| A data seria 16 de abril, ou o lançamento viria no 2º trimestre de 2026 como GPT-5.5 | Há textos tratando Spud como GPT-5.5 e falando em abril–maio ou 2º trimestre de 2026; outro artigo usa linguagem como “leaked April 16 release” e “GPT-5.5 or GPT-6 might mean”, sinalizando incerteza. | Rumor, não confirmação |
| Um post no OpenAI Developer Community confirma “SPUD Release” | A página é um pedido de recurso chamado “Please Add an Optional Expression Mode with the SPUD Release”, não uma release note, documentação de API ou model card. | Não confirma lançamento |
A parte mais sedutora do rumor é também a mais fácil de interpretar errado. Um artigo de Adam Holter menciona que o Claude Mythos Preview teria 77,80% no SWE-bench Pro, enquanto o GPT-5.4 ficaria em 57,70%. Em seguida, o texto fala na expectativa de que o Spud feche boa parte, ou todo, esse intervalo.
Esse detalhe muda tudo. Esses números podem sustentar a frase “há quem especule que o Spud poderia se aproximar do Mythos”. Eles não sustentam a frase “o Spud fez 77,80%” ou “o Spud já superou determinado modelo”.
Para que um benchmark do Spud seja tratado como fato, seria preciso ver algo como: relatório oficial da OpenAI, model card, system card, entrada pública em leaderboard, cartão de avaliação, log de execução, conjunto de prompts, submissão identificável ou teste de terceiros reproduzível.
O SWE-bench é uma referência relevante para checar alegações sobre tarefas de programação, justamente por manter leaderboards públicos. Mas, no material disponível nesta checagem, não há uma entrada verificável associada ao Spud.
Também circulam supostas demonstrações envolvendo simulações 3D, ambientes interativos, design de sites, SVGs e jogos. O problema não é que todo demo seja necessariamente falso. O problema é que, até aqui, eles não provam duas coisas essenciais: que o material foi gerado pelo Spud e que o resultado pode ser reproduzido.
A Geeky Gadgets, por exemplo, atribui as demonstrações à Universe of AI e afirma que métricas oficiais de desempenho continuam não divulgadas. Isso coloca o material na categoria de relato secundário, não de evidência técnica.
Para uma demo subir de nível, seria preciso ter pelo menos o vídeo original completo, o prompt usado, o processo de geração, o nome exato do modelo, data/hora, passos de reprodução ou uma página oficial da OpenAI.
“Vai se chamar GPT-5.5” e “será lançado em tal dia” são as partes que mais rendem manchete — e as que exigem mais cuidado. Há artigo apresentando Spud como GPT-5.5 e sugerindo janela de abril–maio ou 2º trimestre de 2026. Ao mesmo tempo, o texto de Holter fala em “leaked April 16 release” e em “GPT-5.5 or GPT-6 might mean”, uma formulação que não fecha a questão nem sobre a data nem sobre o nome.
Do ponto de vista de checagem, isso ainda não passa do nível de rumor. Enquanto a OpenAI não listar o modelo em documentação oficial, release notes, API ou blog próprio, “GPT-5.5” deve ser tratado como nome usado por terceiros — não como denominação confirmada.
Um detalhe que pode confundir é a presença de “SPUD Release” em um tópico do OpenAI Developer Community. Mas o título da página é “Please Add an Optional Expression Mode with the SPUD Release”, e o contexto é um pedido de funcionalidade feito por usuário.
Esse tipo de menção mostra que a comunidade está discutindo o assunto. Não prova que a OpenAI confirmou lançamento, disponibilidade na API ou nome comercial.
Para equipes de produto, engenharia, agentes de IA ou compras, a conclusão prática é simples: não planeje com base em benchmark não verificado. O caminho mais seguro é:
gpt-5.4, não para Spud ou GPT-5.5.O Spud pode ser real como codinome interno da OpenAI, porque há reportagem mencionando um modelo com esse nome e relato posterior de que seu pré-treinamento teria sido concluído. Mas a parte verificável termina quase aí.
Até que apareçam documentação oficial, entrada de API, model card, system card, benchmark público ou teste reproduzível, não dá para tratar pontuações, demos, data de lançamento ou o nome GPT-5.5 como fatos confirmados.
A melhor frase para usar hoje é: Spud é um codinome de modelo da OpenAI reportado pela imprensa; nome público, capacidades, benchmarks e lançamento ainda não foram confirmados por fontes oficiais ou evidência técnica reproduzível.