404 Media 對 OpenAI 內部計畫「Project Lily」的調查指出,這是一套以真人回饋協助改善模型的流程,素材據報來自真實 ChatGPT 對話。爭議不只在於聊天內容可能被用來改善模型,而是外部承包商即使看不到使用者名稱,仍可能讀到高度私人的生活脈絡。
2
Project Lily 據報如何運作?
根據 404 Media 查閱的外流資料,OpenAI 透過人力派遣公司招募數百名承包商,請他們檢視真實使用者的提問與 ChatGPT 回覆;報導稱,這類工作時薪超過 50 美元。審閱者要摘要使用者意圖、比較 4 個候選回答,再以 1 至 7 分評分。
2
這套流程的目標,據報是改善回答品質,例如讓 ChatGPT 少一點制式、機械化的語氣,減少過度模仿人類感受的說法,以及抑制一味附和、過度奉承使用者的傾向。人類回饋本來就是 AI 開發常見的一環;但若素材是一般消費者的真實對話,隱私問題就格外直接。
2
審閱者可能看見哪些資訊?
404 Media 報導稱,審閱者可能取得完整對話,部分任務還附有「使用者記憶摘要」(user memories summary)。雖然畫面不顯示使用者名稱,但摘要與對話脈絡仍可能透露大致所在地、職業、過往興趣及個人處境。
2
這正是「移除姓名」與「真正匿名」之間的差異。工作、家庭狀況、健康問題或特殊人生事件等片段,單看或許不是帳戶身分證明,合在一起卻仍可能十分敏感。
Privacy Filter 能做到什麼,又做不到什麼?
OpenAI 表示,其 Privacy Filter 是用來偵測並遮蔽文字中個人可識別資訊(PII)的模型。
46
47
就 Project Lily 的報導而言,OpenAI 表示會先移除使用者名稱,並在內容交給承包商前套用自動化篩選器;但 404 Media 指出,敏感細節仍可能穿過這些措施而出現在審閱內容中。
2
原因並不難理解:自動遮蔽較容易辨識姓名、電子郵件、電話等明顯識別項,但含蓄的背景資訊往往更難可靠判定。例如職業、地點、罕見事件與家庭背景的組合,未必會被系統標記,卻可能暴露當事人的私密處境。
審閱人員據報要標記什麼?
報導所述的評分指引,不只看答案是否正確。承包商據稱還要辨識或標記以下問題:
- 制式、不自然的「AI 腔」
- 暗示自己具有人類情緒或親身經歷的說法
- 過度認同、奉承,或其他迎合使用者的回應
- 事實錯誤
- 個人資訊外洩
- 安全風險
2
其中,「過度迎合」(sycophancy)是重點之一。模型若太急著認同使用者,回答可能聽起來很貼心,卻未能質疑錯誤、危險或有害的前提。Project Lily 據報部分目的,就是協助調整這類行為。
2
在對話中寫「這件事別說出去」不是隱私設定
在提示詞裡要求 ChatGPT 保密,不會改變帳戶的資料使用控制。這句話只是聊天內容的一部分,並不是能覆寫 OpenAI 資料設定的技術指令。
針對個人 ChatGPT 工作區,OpenAI 提供的設定是 「為所有人改進模型」(Improve the model for everyone)。啟用時,對話可能被用來改善模型;關閉後,OpenAI 表示不會用新的對話訓練模型。
21
30
如何避免新的 ChatGPT 對話用於改善模型?
已登入的使用者可依下列步驟操作:
- 開啟 ChatGPT 的個人檔案選單。
- 選擇 「設定」。
- 進入 「資料控制」。
- 關閉 「為所有人改進模型」。
19
21
這是帳戶層級設定,不綁定特定裝置。關閉後,既有聊天紀錄仍可保留,但 OpenAI 表示,新的對話不會被用來訓練模型。
19
30
OpenAI 也在其隱私入口網站提供 「不要用我的內容訓練」(Do not train on my content)選項。公司表示,對 ChatGPT 與 Codex 工作而言,使用該選項或在產品內關閉資料控制,擇一即可,不必兩者都做。
21
哪些方案預設有不同保障?
OpenAI 表示,個人工作區的 Free、Plus 與 Pro,預設開啟供模型訓練的資料分享,但使用者可自行退出。至於 ChatGPT Business、Enterprise、Edu,以及 API Platform,OpenAI 表示預設不會使用提供的輸入與輸出訓練模型。
23
不過,這不代表商務對話在任何情境下都毫無風險。企業與組織仍應先確認工作區設定、資料保存政策、分享權限與內部規範,再把機密內容交給任何 AI 工具處理。
重點:把消費型 AI 聊天當成可設定的服務,而非天然保密管道
依 404 Media 的報導,Project Lily 提醒使用者:消費型 AI 對話服務並非天生等同私密通訊管道,而是有資料使用設定可管理的服務。若要輸入高度敏感的個人、法律、醫療、財務或商業機密資訊,最立即的做法是在開始新對話前,先關閉 「為所有人改進模型」。
2
21
請注意,退出設定僅針對 OpenAI 對新對話的模型改善用途;它不是寫在提示詞中的保密要求,OpenAI 的文件也未將其描述為可以撤回已提交內容的方法。
21
30