但這只能證明 OpenAI 有一般安全流程,不能直接證明 GPT-5.5 Spud 這個特定模型已有公開安全評估。若要成立,證據需要直接命名 Spud,或由 OpenAI 明確說明 Spud 被某份已發布的安全文件覆蓋。
核查一個新模型在公布前是否已有安全評估,最有力的公開材料通常包括:
相對地,YouTube 解讀、Reddit 或 Facebook 討論、預測市場題目、非官方 leak 文章,最多只能作為追蹤傳聞的線索;它們本身不是安全評估已公開的證明。
OpenAI 的安全與對齊頁面提到 iterative deployment、從真實世界使用理解威脅,以及部署後持續監測等做法。
OpenAI 的外部紅隊方法文件也指出,紅隊成員有時可能接觸 pre-deployment models 或模型快照;但文件同時提醒,未經 post-training 的快照通常不能代表最終產品部署時的 production safety profile。
這點很重要:即使外界流傳早期測試、內部代號或部署前快照,如果沒有清楚列出模型版本、測試範圍與部署狀態,也不能直接等同於正式發布模型的安全結論。
GPT-5 的公開安全資料較清楚。OpenAI 的 GPT-5 System Card 頁面寫明,GPT-5 models feature safe-completions,用於防止 disallowed content。 OpenAI Deployment Safety Hub 的 GPT-5 頁面也列出 gpt-5-thinking、gpt-5-main 等相關評估與 deployment-safety 資料。
arXiv 版 GPT-5 System Card 摘要也提到,Microsoft AI Red Team 認為 gpt-5-thinking 在 OpenAI 模型中展現出其中一個最強的 AI safety profile。
問題在於:這些文件明確對象是 GPT-5、gpt-5-thinking、gpt-5-main 或 GPT-5 系列中列出的模型;目前可查資料未見它們直接命名 GPT-5.5 Spud,也未見 OpenAI 把 Spud 映射到這些文件。 因此,不應把 GPT-5 的 system card 自動當成 Spud 的安全證據。
目前可查來源中,Spud 主要出現在幾類非官方或二手材料:YouTube 影片以 GPT-5.5 Spud explained 或 leaked 為題;Reddit、Facebook 等平台有用戶討論;Manifold 有關於 OpenAI 是否會公布大於 5.4 的 frontier model 的預測市場問題;也有多篇 blog 或 news-style 文章談 release window、pretraining、live testing、能力推測,或聲稱進入 final safety review。
這些材料可以用來觀察市場傳聞,但不足以回答「有沒有正式安全評估」。即使有頁面標題聲稱 GPT-5.5 Spud released,或聲稱模型進入 final safety review,只要沒有公開測試方法、模型版本、風險分類、紅隊結果或官方安全結論,就仍然不是可核查的 Spud-specific safety artifact。
另一些來源確實涉及 OpenAI 模型安全測試,但測試對象不是 GPT-5.5 Spud。Promptfoo 與 SPLX 的頁面討論 GPT-5 red-teaming 或 security testing,對象是 GPT-5。 Kaggle 的 OpenAI gpt-oss-20b Red-Teaming Challenge,對象則是 gpt-oss-20b;相關總結也圍繞 gpt-oss safety evaluation。
這些資料有助理解 AI 紅隊測試如何進行,但若要證明 Spud 公布前已有安全評估,測試文件需要直接命名 GPT-5.5 Spud,或由官方文件清楚說明兩者關係。
| 核查問題 | 公開資料狀態 | 判斷 |
|---|---|---|
| OpenAI 是否有一般 safety/alignment/red-teaming 流程? | OpenAI 有公開安全與對齊說明、外部紅隊材料,以及 Red Teaming Network。 | 有證據支持 |
| GPT-5 是否有 system card 或 deployment-safety 文件? | OpenAI 有 GPT-5 System Card 與 Deployment Safety Hub 頁面。 | 有證據支持 |
| GPT-5.5 Spud 公布前是否有官方 system card? | 目前可查來源未見 OpenAI 官方 Spud system card;Spud 相關材料多屬影片、社群帖文、預測市場或非官方文章。 | |
| GPT-5 的安全文件能否直接證明 Spud 安全? | GPT-5 文件的明確對象是 GPT-5、gpt-5-thinking 等;未見官方把它直接延伸到 Spud。 | 不應直接等同 |
| 是否有第三方 Spud-specific red-team report? | 目前可查來源有 GPT-5 或 gpt-oss 測試,但未見直接命名 Spud 的可核查紅隊報告。 |
如果之後出現以下任何一類材料,判斷就應更新:
在這些資料出現之前,把「OpenAI 一般有紅隊流程」寫成「Spud 已通過紅隊測試」,會是過度推論。較準確的說法是:OpenAI 有公開的一般安全、對齊與 red-teaming 流程;GPT-5 本身也有 system card 與 deployment-safety 資料;但就 GPT-5.5 Spud 而言,目前可查公開資料未能證明公布前已有直接對應該模型的安全評估、紅隊測試或對齊證據。
換句話說,結論是 insufficient public evidence。這不排除 OpenAI 內部做過未公開評估;但未公開的內部工作,不能當成可引用的公開證據。
| 未能確認 |
| 未能確認 |