Verdict : preuves publiques insuffisantes.
Ce que l’on peut affirmer, c’est qu’OpenAI décrit des pratiques générales : déploiement itératif, apprentissage à partir des usages réels, surveillance après déploiement et autres défenses systémiques. L’entreprise met aussi en avant des travaux de red teaming externe et automatisé, ainsi qu’un Red Teaming Network présenté comme une communauté d’experts de confiance et expérimentés pour aider à l’évaluation et à la réduction des risques.
Mais cela établit l’existence d’un cadre général chez OpenAI, pas l’existence d’une évaluation publique spécifique à Spud. Pour conclure que GPT-5.5 Spud a été évalué publiquement avant son annonce, il faudrait un document qui nomme explicitement Spud, ou une déclaration officielle d’OpenAI indiquant que Spud est couvert par une fiche de sécurité déjà publiée.
Pour vérifier la sécurité d’un nouveau modèle, les pièces les plus convaincantes seraient généralement :
À l’inverse, des vidéos YouTube, fils Reddit ou Facebook, questions de marchés de prédiction et articles de fuite non confirmés peuvent servir de signaux à surveiller. Ils ne constituent pas, en eux-mêmes, la preuve qu’une évaluation de sécurité a été publiée.
OpenAI indique que le déploiement itératif l’aide à comprendre les menaces issues de l’usage réel, et mentionne aussi une surveillance continue après déploiement. L’entreprise a par ailleurs publié des documents sur le red teaming externe. Un point important y est précisé : des red teamers peuvent parfois accéder à des modèles ou snapshots pré-déploiement, mais des snapshots non finalisés, avant post-entraînement, ne représentent généralement pas le profil de sécurité du modèle destiné à la production.
C’est une distinction essentielle. Même si une rumeur mentionne un nom de code interne, un test préliminaire ou un snapshot, cela ne suffit pas à établir le niveau de sécurité du modèle final. Il faut connaître la version évaluée, le périmètre du test et le statut de déploiement.
Le cas de GPT-5 est mieux documenté. La system card officielle d’OpenAI indique que les modèles GPT-5 utilisent les safe-completions, une approche destinée à prévenir les contenus interdits. La page GPT-5 de l’OpenAI Deployment Safety Hub présente aussi des évaluations et éléments de deployment safety concernant notamment gpt-5-thinking et gpt-5-main.
La version arXiv de la GPT-5 System Card indique également que Microsoft AI Red Team a conclu que gpt-5-thinking affichait l’un des profils de sécurité IA les plus solides parmi les modèles d’OpenAI.
Mais ces éléments concernent GPT-5, gpt-5-thinking, gpt-5-main ou d’autres variantes explicitement listées. Les sources examinées ne montrent pas que ces documents nomment GPT-5.5 Spud, ni qu’OpenAI ait officiellement relié Spud à ces évaluations. Il serait donc abusif de traiter la system card de GPT-5 comme une preuve automatique de sécurité pour Spud.
Dans les sources disponibles, Spud apparaît surtout dans des contenus secondaires ou non officiels : vidéos YouTube promettant d’expliquer ou de révéler GPT-5.5 Spud, discussions sur Reddit ou Facebook, marché de prédiction Manifold sur l’annonce éventuelle d’un modèle OpenAI supérieur à 5.4, ou encore articles évoquant une fenêtre de sortie, le pré-entraînement, des tests en direct, des capacités supposées ou une prétendue revue finale de sécurité.
Ces éléments peuvent aider à suivre les rumeurs du secteur. Ils ne répondent pas à la question de fond : existe-t-il une évaluation de sécurité publique, vérifiable, directement liée à Spud ? Même une page titrée comme si GPT-5.5 Spud était déjà sorti, ou affirmant qu’il serait en revue finale de sécurité, ne suffit pas si elle ne publie pas de méthode de test, de version de modèle, de classification des risques, de résultats de red team ou de conclusion officielle.
D’autres sources parlent bien de tests de sécurité sur des modèles OpenAI, mais pas sur GPT-5.5 Spud. Promptfoo et SPLX discutent de red teaming ou de tests de sécurité portant sur GPT-5. Le challenge Kaggle OpenAI gpt-oss-20b Red-Teaming, lui, concerne gpt-oss-20b, pas Spud.
Ces travaux peuvent être utiles pour comprendre les méthodes de red teaming appliquées aux modèles d’IA. Ils ne prouvent pas qu’un modèle appelé GPT-5.5 Spud ait été évalué avant une annonce publique.
| Question | État des preuves publiques | Lecture |
|---|---|---|
| OpenAI dispose-t-elle de pratiques générales de sécurité, d’alignement et de red teaming ? | Oui : OpenAI publie des pages sur la sécurité, l’alignement, le red teaming externe et son Red Teaming Network. | Établi |
| GPT-5 dispose-t-il d’une system card ou de documents de deployment safety ? | Oui : OpenAI publie une GPT-5 System Card et une page GPT-5 dans le Deployment Safety Hub. | Établi |
| Existe-t-il une system card officielle pour GPT-5.5 Spud ? | Les sources examinées ne montrent pas de system card OpenAI nommant Spud ; les mentions disponibles viennent surtout de vidéos, réseaux sociaux, marchés de prédiction ou articles non officiels. | |
| Les documents GPT-5 prouvent-ils la sécurité de Spud ? | Les documents cités visent GPT-5, gpt-5-thinking ou gpt-5-main ; aucun lien officiel avec Spud n’apparaît dans les sources examinées. | Non, pas automatiquement |
| Existe-t-il un rapport de red team tiers spécifique à Spud ? | Les sources disponibles incluent des tests sur GPT-5 ou gpt-oss, mais pas de rapport vérifiable nommant Spud. |
Le verdict devrait être révisé si l’un de ces éléments apparaissait :
En attendant, écrire qu’OpenAI possède des processus de red teaming ne revient pas à prouver que Spud a passé un red team public. La formulation la plus exacte est donc : OpenAI a publié des pratiques générales de sécurité, d’alignement et de red teaming ; GPT-5 dispose de documents de sécurité ; mais, pour GPT-5.5 Spud, les sources publiques examinées ne prouvent pas l’existence d’une évaluation de sécurité, d’un rapport de red team ou d’un document d’alignement directement associé au modèle.
Autrement dit : insufficient public evidence. Cela n’exclut pas qu’OpenAI ait mené des évaluations internes non publiées. Mais ce qui n’est pas public ne peut pas être cité comme preuve publique.
| Non confirmé |
| Non confirmé |