OpenAI表示,Private Safety Processing 可在不向員工提供客戶提示詞或模型回覆的情況下,辨識分散於多次互動的濫用模式,並兼容零資料保留(ZDR)。[3][1] 系統只會向 OpenAI 發出狹義的安全訊號,例如活動類別或風險程度,而不是原始內容或可還原的完整對話紀錄。[3][10] 如果偵測到可疑活動,後續可能包括風險提示及帳戶層面的安全措施;企業可選擇自行調查,或自願提供相關背景,但 OpenAI 不會因而自動取得保留中的對話。[3]
研究答案

Create a landscape editorial hero image for this Studio Global article: How does OpenAI’s newly previewed Private Safety Processing service, announced on August 19, 2026, seek to balance AI misuse detection with. Article summary: OpenAI’s preview is a privacy-preserving alternative to conventional abuse monitoring: it aims to identify multi-turn misuse patterns while keeping Zero Data Retention (ZDR) customers’ prompts and outputs unavailable to . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
OpenAI今次預告的 Private Safety Processing,核心賣點可以濃縮成一句:想睇到濫用風險,但唔想保留客戶內容。
呢項服務於2026年8月19日公布,目前只向部分客戶作預覽測試。OpenAI表示,系統會在維持零資料保留(Zero Data Retention,簡稱 ZDR)保障的同時,加強對跨多次互動風險的偵測。31
傳統兼容ZDR的安全機制,主要逐一評估每次輸入和輸出。問題在於,有些濫用行為未必會在單一請求中顯露出來:每一個要求單獨睇可能都未算明顯,但連貫起來,可能構成入侵活動、惡意程式開發,或者其他高風險工作流程。
Private Safety Processing的設計,就是將分析範圍擴展至相關互動及多段對話,讓自動系統尋找跨工作階段的風險訊號。例如,一連串看似零散的要求,可能合力支援一個針對系統的攻擊;即使沒有任何一個請求足以單獨定性,整體模式仍可能引起警示。31
按OpenAI的說法,分析由自動系統進行,OpenAI員工不會接觸構成該模式的原始提示詞或模型回覆。系統的目標,是只輸出一個狹義的安全訊號,而非把內容交給人工審查員,亦不建立一份可供人員還原的完整對話紀錄。3
客戶內容可以留在客戶控制的基礎設施,或以由客戶持有的密鑰加密保存;重點是,對OpenAI而言,安全監察收到的是有限度的風險資料,而不是原文內容。711
實際後續行動,預計會以風險提示及帳戶層面的安全措施為主,而不是直接展開內容審查。OpenAI可能要求企業自行調查,或者邀請客戶自願提供相關背景資料;企業是否合作,並非OpenAI自動取得對話內容的途徑。310
不過,呢項安排暫時仍有一個重要限制:Private Safety Processing只屬選定客戶參與的有限度預覽。它如何處理誤報、風險訊號具體包含甚麼,以及觸發警示後會採取哪些執行措施,現階段尚未有足夠獨立資料驗證。310
Anthropic在2026年6月公布,對涵蓋的 Mythos 類模型及未來具相近能力的模型,要求保留企業客戶提交的提示詞和模型輸出30日,作信任與安全用途;政策亦適用於模型提供的不同平台。
保留資料的做法,讓Anthropic可以在發生事故後回看紀錄,並進行有限度、受控的人工審查。公司表示,人工存取會被記錄,並設有防篡改式的審查紀錄及刪除安排;其理由是,部分複雜或新型攻擊,只有在檢視多次請求後才較容易調查和處理。
其後報道指,Anthropic預計維持30日保留要求,但可能容許客戶將資料放在自家雲端基礎設施,而不一定由Anthropic直接保存。
兩種方案的取捨相當清楚:
兩者都唔代表風險完全消失。OpenAI要面對誤報或漏報問題;Anthropic則要處理「邊個可以睇資料、資料放喺邊、幾時刪除」等資料治理問題。
今次公布唔只係一項技術安全更新,亦明顯涉及企業客戶爭奪。報道指,Anthropic截至2026年7月底的年化收入跑速超過650億美元;要留意,年化收入跑速是按近期表現推算全年規模,並不等於已入帳的全年收入。
另外,有投資者預期Anthropic日後上市時的估值可能達到2萬億美元或以上,但呢個仍然屬市場預期,並非已確定的IPO估值或保證結果。
在呢個背景下,OpenAI主打「安全監察但不保留客戶內容」,可以理解為針對受監管及高度重視保密的企業,嘗試拆除採購時常見的資料留存障礙,而不只是單純提升濫用偵測能力。310
至於OpenAI自己的IPO時間表或條款,現有資料不足以作出可靠定性。任何「OpenAI已確定即將上市」之類的說法,都需要另行以最新及可靠資料確認。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
OpenAI表示,Private Safety Processing 可在不向員工提供客戶提示詞或模型回覆的情況下,辨識分散於多次互動的濫用模式,並兼容零資料保留(ZDR)。[3][1]
OpenAI表示,Private Safety Processing 可在不向員工提供客戶提示詞或模型回覆的情況下,辨識分散於多次互動的濫用模式,並兼容零資料保留(ZDR)。[3][1] 系統只會向 OpenAI 發出狹義的安全訊號,例如活動類別或風險程度,而不是原始內容或可還原的完整對話紀錄。[3][10]
如果偵測到可疑活動,後續可能包括風險提示及帳戶層面的安全措施;企業可選擇自行調查,或自願提供相關背景,但 OpenAI 不會因而自動取得保留中的對話。[3]