OpenAI 於 2026 年 8 月 19 日預覽的 Private Safety Processing,核心並不是取消濫用監測,而是嘗試改變「監測必須先保存客戶內容」這個前提。這套機制面向採用 Zero Data Retention(ZDR,零資料留存) 部署的企業客戶,目標是在維持提示詞與模型回應不供 OpenAI 人員查看、也不作為客戶內容留存的情況下,找出跨多次互動才看得出的 AI 濫用風險。31
從逐次檢查,擴展到跨對話分析
傳統的 ZDR 相容安全系統主要逐一評估每次互動。這種做法對單一明顯的惡意請求可能有效,但若攻擊者把目標拆成多個看似普通的步驟,單次檢查便可能難以判斷整體意圖。
Private Safety Processing 旨在把分析範圍延伸至相關的輸入與輸出,以及多段對話之間的關聯模式。換句話說,系統不只問「這一次請求是否有問題」,也試圖判斷多次互動是否共同構成一個可疑工作流程,例如逐步支援惡意軟體開發或入侵行動。即使沒有任何一則請求單獨達到明確違規門檻,分散在多次對話中的線索仍可能被自動系統串聯起來。31
OpenAI 將這項能力描述為可用來防範惡意人類使用者,也可用來偵測可能失控、試圖發動駭侵活動的 AI 代理程式。1
OpenAI 看得到什麼?看不到什麼?
OpenAI 表示,Private Safety Processing 的分析由自動化系統執行,並不因此讓公司人員取得底層客戶內容。系統預計回傳的是範圍狹窄的安全訊號,例如活動的類型或風險程度,而不是原始提示詞、模型回應,或能重建整段對話的資料。32
這代表企業可在下列兩種資料控管安排下維持內容隔離:資料留在客戶控制的基礎架構中,或以由客戶持有的專屬金鑰加密保存。79 不過,實際部署細節與技術驗證仍須等待更完整的文件和測試結果;目前功能只是向部分客戶提供的預覽版本。35
觸發警示後,企業會面臨什麼?
按照目前披露的設計,偵測到可疑活動後,OpenAI 的後續處置重點是風險訊號與帳戶層級的安全措施,而不是直接把客戶內容交給人工審查。OpenAI 可能要求企業自行調查,也可能請企業自願提供相關背景,以協助釐清警示;客戶是否提供資料,並非 OpenAI 自動取得保存對話的途徑。310
但這項服務尚未經過大規模公開運作驗證,因此仍有幾個關鍵問題沒有答案:訊號在多複雜的情況下仍能保持準確?誤判如何處理?帳戶層級的處置標準為何?在選定客戶進行的有限預覽階段,這些機制的實際表現仍未獨立確立。310
與 Anthropic 的 30 天留存政策有何不同?
Anthropic 針對其定義的「涵蓋模型」採取另一條路線:企業客戶提交給 Mythos 類模型的提示詞,以及模型產生的回應,須保留 30 天。這項要求也適用於未來具備相近能力的模型,目的是支援信任與安全工作,包括調查新型態的安全威脅。
Anthropic 的做法允許在嚴格限制下對留存內容進行有限人工審查;公司表示會記錄所有人工存取,並以防竄改方式管理相關紀錄,資料通常會在 30 天後刪除。6 其政策邏輯是,若要調查跨多次請求才顯現的複雜攻擊、降低誤判,安全團隊需要一定的回溯窗口。
後續報導指出,Anthropic 預計保留 30 天的要求,但可能讓企業選擇把資料放在自己的雲端基礎架構,而不是由 Anthropic 代為保存。 這可降低部分資料託管疑慮,卻不等於取消留存義務。
兩種模式的真正取捨
OpenAI 的賭注是:只要自動化系統能從有限的安全訊號中準確辨識跨對話濫用,就能同時滿足高機密性企業對 ZDR 的要求,以及模型供應商對安全監測的需求。Anthropic 則接受短期資料留存與受控人工審查,因為它認為事後調查和模型安全監督不可或缺。
兩種方式都不是零風險方案:
- OpenAI 的風險在於訊號資訊量較少,若辨識不夠準確,可能漏掉分散式攻擊,或造成誤判。
- Anthropic 的風險在於企業必須承擔更大的資料保管、存取治理與合規責任,即使資料只保留 30 天。
因此,企業採購時不只是比較「哪家公司更重視隱私」,而是要評估自身更需要哪一種能力:OpenAI 所主張的內容不留存監測,或 Anthropic 所提供的可回溯、可人工調查機制。
這也是一場企業市場競爭
Private Safety Processing 的推出,也具有明顯的企業市場競爭意味。Anthropic 年化營收跑率據報在 2026 年 7 月底超過 650 億美元;這是根據近期銷售速度推算的全年化指標,不等同於已入帳的全年營收。 另有報導引述投資人預期,Anthropic 若在秋季上市,估值可能達到 2 兆美元以上。
這些數字反映市場對 Anthropic 成長速度與潛在 IPO 的預期,但不是經審計的財務表現,也不是已確定的上市估值。對 OpenAI 而言,強調在 ZDR 下仍能進行長期安全監測,可能有助於排除金融、醫療、法律與資安等高敏感產業在採購時最在意的資料留存障礙;它不只是一次技術更新,也是一項企業隱私定位。310
至於 OpenAI 自身的 IPO 計畫,現有資料不足以確認其時程、條件或是否即將上市。任何「OpenAI 已確定近期 IPO」的說法,都需要另行取得最新且可靠的確認;不能僅以 Anthropic 的上市報導推論。