但这只能说明OpenAI有一套通用安全流程。要证明GPT-5.5 Spud这个特定模型在发布前已经有公开安全评估,证据必须更直接:要么文件直接写明Spud,要么OpenAI明确说明Spud被某份已发布的安全文件覆盖。
换句话说,不能因为“OpenAI通常会做安全评估”,就推出“Spud已经通过了公开红队测试”。这中间差了一步关键证据。
核查一个新模型在发布前是否已有安全评估,最有力的通常是以下几类材料:
相反,YouTube解读、Reddit或Facebook讨论、预测市场问题、非官方爆料文章,最多只能作为线索;它们本身不是安全评估已经公开的证明。
OpenAI的安全与对齐页面提到,公司会采用迭代部署,从真实世界使用中理解威胁,并在部署后进行持续监测。
OpenAI关于外部红队测试的材料还指出,红队人员有时可能接触pre-deployment models或snapshots,也就是部署前模型或快照;但文件同时提醒,未经post-training的快照通常不能代表最终生产环境中的安全画像。
这一点很重要。即便出现早期测试、内部代号或部署前快照的传闻,只要没有清楚列出模型版本、测试范围和部署状态,就不能直接等同于正式发布模型的安全结论。
GPT-5的公开安全资料相对清楚。OpenAI的GPT-5 System Card页面写明,GPT-5 models采用safe-completions,用于防止不允许的内容输出。 OpenAI Deployment Safety Hub的GPT-5页面也列出gpt-5-thinking、gpt-5-main等相关评估与deployment-safety资料。
arXiv版GPT-5 System Card摘要还提到,Microsoft AI Red Team认为gpt-5-thinking在OpenAI模型中展现出其中一个最强的AI安全画像。
问题在于,这些文件明确对应的是GPT-5、gpt-5-thinking、gpt-5-main或GPT-5系列中列出的模型;目前来源中没有看到它们直接命名GPT-5.5 Spud,也没有看到OpenAI把Spud映射到这些文件。 因此,不能把GPT-5的System Card自动当成Spud的安全证据。
本次资料中,Spud主要出现在几类非官方或二手材料里:YouTube视频以GPT-5.5 Spud explained或leaked为题;Reddit、Facebook等平台有用户讨论;Manifold上有关于OpenAI是否会在2026年5月1日前发布大于5.4的frontier model的预测市场问题;还有多篇博客或新闻风格文章讨论发布时间窗口、预训练、在线测试、能力猜测,或声称进入final safety review。
这些材料可以用来观察市场传闻,但不足以回答“有没有正式安全评估”。即使某些页面标题声称GPT-5.5 Spud已经发布,或声称进入final safety review,只要没有公开测试方法、模型版本、风险分类、红队结果或官方安全结论,它仍然不是可核查的Spud专属安全材料。
还有一些来源确实涉及OpenAI模型安全测试,但测试对象不是GPT-5.5 Spud。Promptfoo和SPLX的页面讨论GPT-5红队测试或安全测试,对象是GPT-5。 Kaggle的OpenAI gpt-oss-20b Red-Teaming Challenge,对象则是gpt-oss-20b;相关总结也围绕gpt-oss安全评估展开。
这些资料有助于理解AI红队测试通常怎么做,但若要证明Spud发布前已有安全评估,测试文件需要直接命名GPT-5.5 Spud,或由官方文件清楚说明两者的关系。
| 核查问题 | 公开资料状态 | 判断 |
|---|---|---|
| OpenAI是否有一般性的safety、alignment、red-teaming流程? | OpenAI公开过安全与对齐说明、外部红队材料,以及Red Teaming Network。 | 有证据支持 |
| GPT-5是否有System Card或deployment-safety文件? | OpenAI有GPT-5 System Card与Deployment Safety Hub页面。 | 有证据支持 |
| GPT-5.5 Spud发布前是否有官方System Card? | 目前来源未见OpenAI官方Spud System Card;Spud相关材料多为视频、社交帖、预测市场或非官方文章。 | |
| GPT-5安全文件能否直接证明Spud安全? | GPT-5文件的明确对象是GPT-5、gpt-5-thinking等;未见官方直接延伸到Spud。 | 不应直接等同 |
| 是否有第三方Spud专属红队报告? | 现有资料包含GPT-5或gpt-oss测试,但未见直接命名Spud的可核查红队报告。 |
如果之后出现以下任意一类材料,判断就应该更新:
在这些材料出现之前,更准确的写法是:OpenAI有公开的一般安全、对齐与红队流程;GPT-5本身也有System Card和deployment-safety资料;但就GPT-5.5 Spud而言,目前可查公开资料还不能证明发布前已有直接对应这个模型的安全评估、红队测试或对齐证据。
这并不排除OpenAI内部做过尚未公开的评估。只是从公开核查的角度看,未公开的内部工作不能当作可引用的公开证据。
| 未能确认 |
| 未能确认 |