404 Media 於 2026 年 9 月 15 日報導,OpenAI 的「Project Lily」據稱安排數百名透過人力派遣公司聘用、時薪逾 50 美元的承包商,檢閱真實的消費者 ChatGPT 對話。 報導指評審員會摘要使用者意圖、比較 4 個候選回覆並以 1 至 7 分評分,目標是讓 ChatGPT 少一點制式感與逢迎感,回答更自然可靠。
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Media 對 OpenAI 內部「Project Lily」的調查指出,一套用於人類回饋的作業流程,會以真實的消費者 ChatGPT 對話來評估模型回覆。根據該媒體取得的外洩資料、提示詞範例與公司說法,外包承包商可能閱讀對話脈絡來評分模型表現;其中有些對話可能包含敏感個人資訊。 1
對於會用 ChatGPT 討論個人、健康、感情、法律或工作問題的人,重點很簡單:在提示詞裡要求聊天機器人「保密」,不是帳號層級的存取控制設定。真正相關的是帳號是否允許新的對話用於模型改進。 1
404 Media 報導稱,數百名由人力派遣公司聘用、時薪超過 50 美元的承包商,會檢閱大量真實的 ChatGPT 對話。他們的工作據報包括:
報導所述的評估標準,著重於改善 ChatGPT 回答的品質與互動感受。評審員會被指示標記帶有「AI 腔」的措辭、錯誤的事實主張、過度迎合或諂媚的語氣、安全疑慮,以及錯誤暗示模型具有個人經驗或情緒的回覆。 1
這類回饋循環的目的,是讓回答更自然、少一點機械感;但也代表,改善服務的過程可能涉及人工接觸使用者對話的實質內容。 1
OpenAI 向 404 Media 表示,資料送交評審前會移除使用者名稱,並套用 Privacy Filter(隱私篩選器)。不過,調查發現,評審資料可能含有完整對話脈絡與模型生成的記憶摘要;這些摘要據報可能包含大致所在地、職業與非常私密的個人處境。 1
問題在於「脈絡式辨識」。即使姓名或帳號識別資訊已刪除,人生事件、工作細節、地理資訊或罕見描述的組合,仍可能讓認識當事人的人辨認出來;即使無法直接對應身分,這些內容本身也可能極具敏感性。404 Media 報導,OpenAI 承認篩選器可能難以處理不常見的識別資訊,以及含義模糊、必須依上下文才能判斷的私人指涉。 1
在對話中要求 ChatGPT 保密,只是給模型的對話指令,不是帳號的隱私偏好設定。它不會凌駕服務的資料使用設定,也不會阻止對話被納入 404 Media 所描述的改進流程。 1
因此,不應因為聊天感覺私密,就把消費型聊天機器人視為機密通訊管道。若資訊一旦被授權評審員看到便可能造成傷害,較安全的做法是:不要在已開啟模型改進的個人工作區輸入這些內容。
OpenAI 的「資料控制」說明指出,個人工作區使用者可依下列步驟關閉模型改進:
關閉後,新的對話仍會保留在聊天紀錄中,但不會用於訓練或改進 ChatGPT 模型。此設定套用於整個帳號,並非只限某一台裝置。
時間點很重要:OpenAI 表示,選擇退出只適用於新的對話;它不會追溯移除先前在模型改進已開啟時提交的聊天內容。
OpenAI 表示,ChatGPT Business、Enterprise、Edu 以及 API Platform 的輸入與輸出內容,預設不會用於訓練模型。相對地,個人工作區的 ChatGPT Free、Plus 與 Pro 使用者,預設開啟模型改進資料分享,但可在「資料控制」中選擇退出。
這項差異不代表組織就不必處理所有資料治理義務。團隊仍應遵守雇主或學校的內部規範,並確認所屬工作區的實際設定;但它確實與消費者對話的預設處理方式不同。
人工檢閱並非 OpenAI 獨有。Anthropic 的隱私政策指出,除非使用者選擇退出,該公司可能利用使用者或群眾工作者提供的輸入與輸出內容來訓練及改進模型。 一篇檢視主要 AI 供應商隱私實務的學術研究也發現,Google 與 OpenAI 都談及以人工檢閱使用者聊天內容,用於模型訓練或改進。
因此,核心問題不只是「是否存在人工回饋」,而是使用者是否清楚知道:哪些對話可能進入流程、去識別化能與不能保護什麼,以及如何變更適用設定。
依 404 Media 的報導,「Project Lily」提醒人們:消費型 AI 聊天並非天然是一對一、完全保密的交流。去識別化措施或許能降低曝露風險,但對於充滿個人脈絡的對話,未必能消除所有可揭露身分或敏感處境的細節。 1
在 ChatGPT 輸入敏感資訊前,先查看 設定 → 資料控制 → 為所有人改進模型。若模型改進已開啟,應將新的對話視為可能符合用於改進服務的資格;若已關閉,OpenAI 表示新的聊天不會用於該目的。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
404 Media 於 2026 年 9 月 15 日報導,OpenAI 的「Project Lily」據稱安排數百名透過人力派遣公司聘用、時薪逾 50 美元的承包商,檢閱真實的消費者 ChatGPT 對話。
404 Media 於 2026 年 9 月 15 日報導,OpenAI 的「Project Lily」據稱安排數百名透過人力派遣公司聘用、時薪逾 50 美元的承包商,檢閱真實的消費者 ChatGPT 對話。 報導指評審員會摘要使用者意圖、比較 4 個候選回覆並以 1 至 7 分評分,目標是讓 ChatGPT 少一點制式感與逢迎感,回答更自然可靠。 [1]
OpenAI 據報會移除使用者名稱並套用隱私篩選器,但 404 Media 發現對話脈絡與記憶摘要仍可能帶出大致所在地、職業及高度私密的人生細節。 [1]