404 Media 的調查指,OpenAI 內部一個名為 Project Lily 的計劃,會以真實 ChatGPT 用戶對話作為人類回饋材料。爭議不只在於對話可能被用作改進模型,而在於外判評核員即使看不到用戶名稱,仍可能讀到相當私人的背景資料。
2
「Project Lily」據報點樣運作?
按 404 Media 查閱到的外洩材料,OpenAI 經人力公司招募數百名外判人員,審閱真實用戶提示詞及 ChatGPT 回覆;報道指薪酬超過每小時 50 美元。評核員要先概述用戶意圖,再比較 4 個候選回覆,並以 1 至 7 分評分。
2
據報,計劃目的包括改善回答質素,令 ChatGPT 少啲生硬的「機械腔」、少啲扮作有人類感受或親身經歷,亦減少一味附和、過度奉承用戶的傾向。這類人類回饋本來是 AI 開發常見做法,但若材料來自真實消費者對話,私隱問題就變得更直接。
2
評核員可能睇到咩?
404 Media 報道指,評核員可能收到完整對話,部分工作更附有 「用戶記憶摘要」。雖然不會顯示用戶名稱,但摘要或對話內容仍可透露大概所在地、職業、過往興趣及個人處境。
2
關鍵在於:刪走姓名,不等於對話在實際上已沒有私隱風險。工作、家庭、健康問題,或一件獨特經歷等資料拼湊起來,即使未必直接指向帳戶持有人,仍然可以相當敏感。
Privacy Filter 做到乜、做唔到乜?
OpenAI 表示,其 Privacy Filter 是一個用來偵測及遮蓋文字中個人可識別資料(PII)的模型。
46
47
就 Project Lily 的報道,OpenAI 指在材料交給外判人員前,會移除用戶名稱並使用自動過濾工具;但 404 Media 報道稱,敏感細節仍可能穿過這些措施而出現在評核內容中。
2
這反映自動遮蓋的限制:姓名、電郵、電話號碼等明顯識別資料較易辨認;但一個人的工作、家庭狀況、地點線索和特別事件所構成的「背景拼圖」,就難得多用自動系統準確判斷。
評核員據報要標記邊類問題?
報道所述指引不只著眼於答得啱唔啱。外判人員據報亦要找出:
- 套版、唔自然的「AI 腔」
- 暗示自己有人的感受或生活經驗的說法
- 過度認同、奉承或迎合用戶的回覆
- 事實錯誤
- 個人資料外洩
- 安全風險
2
其中「過度迎合」尤其值得留意。一個太急於認同用戶的模型,表面上可能好支持人,但同時未必會質疑錯誤、危險或有害的前提。據報 Project Lily 的部分工作,正是用來調整這種行為。
2
叫 ChatGPT「呢件事你知我知」並非私隱設定
在提示詞內寫「保密」或「唔好畀人睇」,不會改變帳戶的資料使用設定。這句說話只是對話內容的一部分,並不是可凌駕 OpenAI 資料控制機制的技術指令。
對個人 ChatGPT 工作區而言,OpenAI 提供的相關控制項是 Improve the model for everyone。選項開啟時,對話可能會用作改進模型;關閉後,OpenAI 指不會以其後的新對話訓練模型。
21
30
點樣關閉新對話的模型改進用途?
已登入 ChatGPT 的用戶可按以下步驟操作:
- 開啟 ChatGPT 的個人檔案選單。
- 選擇 Settings。
- 進入 Data Controls。
- 關閉 Improve the model for everyone。
19
21
這是帳戶層面的設定,不會只限於某一部手機或電腦。關閉後,原有對話紀錄仍可保留,但 OpenAI 指其後的新對話不會被用作訓練模型。
19
30
OpenAI 亦在私隱入口提供 Do not train on my content 選項;公司表示,對 ChatGPT 及 Codex 工作而言,使用這個選項或在產品內關閉 Data Controls 其中一項已足夠,毋須兩邊都做。
21
邊類 ChatGPT 方案預設受保障?
OpenAI 表示,個人工作區的 Free、Plus 及 Pro 預設會啟用資料分享作模型訓練,但用戶可以選擇退出。至於 ChatGPT Business、Enterprise、Edu 及 API Platform,OpenAI 指預設不會將所提供的輸入及輸出用來訓練模型。
23
不過,這不代表商業帳戶下的每段對話就對任何用途都「零風險」。機構仍應審視工作區設定、保存政策、分享權限及內部規則,才決定是否把機密材料交予任何 AI 工具處理。
實際要點:敏感內容,先關設定再傾
404 Media 對 Project Lily 的報道提醒大家,消費者版 AI 對話應視為一項設有資料使用控制的網上服務,而不應預設是絕對保密的渠道。若內容涉及高度敏感的個人、法律、醫療、財務或商業機密資料,最直接的做法是在開始新對話之前,先關閉 Improve the model for everyone。
2
21
退出設定只控制 OpenAI 對新對話的模型改進用途;它不是寫在提示詞內的一句要求,而 OpenAI 的說明亦沒有指這可撤回已經提交的內容。
21
30