404 Media 在 2026 年 9 月 15 日報道,OpenAI 的「Project Lily」據報聘用數百名經人力公司聘請、時薪逾 50 美元的外判人員,評核真實消費者的 ChatGPT 對話。 審閱人員據報要概括用戶意圖、比較 4 個候選回答,再以 1 至 7 分評分,目標是令 ChatGPT 少啲機械腔、少啲一味附和,回答更自然可靠。
發布者使用 GPT-5.6 Terra 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Media 調查 OpenAI 內部「Project Lily」後報道,ChatGPT 的部分真實消費者對話,據稱會流入由真人參與的品質評核流程。按該媒體看過的外洩資料、提示範例及公司說法,外判人員可能會閱讀整段對話背景,以評估模型回答;即使內容涉及相當私人的事。1
對用 ChatGPT 問健康、感情、法律或工作問題嘅人,最要緊嘅一點係:喺對話入面叫它「幫我保密」,唔係帳戶層面嘅存取控制。真正相關嘅選項,是帳戶有冇容許新對話用於改進模型。1
404 Media 指,數百名經人力公司聘請、時薪超過 50 美元嘅外判人員,會審閱大量真實 ChatGPT 對話。他們據報要:
報道所述嘅評分準則,着眼於改善 ChatGPT 回答嘅質感同可靠性。審閱人員會標記帶有濃厚 AI 腔嘅措辭、事實錯誤、過分認同用戶嘅討好式回答、安全問題,以及模型假裝自己有個人經歷或情緒嘅說法。1
呢個人類回饋循環,本意係令回答更自然、少啲死板;但同時代表,要改善品質,有機會涉及真人接觸對話內容。1
OpenAI 向 404 Media 表示,資料交予審閱人員前會移除用戶名,亦會套用「Privacy Filter」私隱篩選器。不過,調查發現評核材料可包含完整對話背景,以及模型生成嘅記憶摘要;摘要據報有機會包括大概所在地、職業同非常私人的人生處境。1
問題在於「背景資料」本身都可以令人辨認身份。即使姓名或帳戶識別資料被刪除,獨特嘅生活事件、工作細節、地理位置或少見提及,仍可能令認識當事人嘅人猜到係邊個;即使未必辨認到身份,資訊本身亦可能已相當敏感。404 Media 報道指,OpenAI 承認篩選器較難處理罕見識別資料,以及含糊、須靠上下文先理解嘅私隱提及。1
叫 ChatGPT 保密,只係對話內容中嘅一項指示,唔係帳戶私隱設定。它唔會凌駕服務嘅資料使用選項,亦唔會阻止對話被抽中,進入 404 Media 所描述嘅模型改進流程。1
所以,唔應該因為對話感覺私密,就將一般消費者聊天機械人當成保密渠道。假如某些資料即使只向獲授權嘅審閱人員披露都會造成風險,較穩妥做法係:在個人工作區仍開啟模型改進時,唔好輸入呢類資料。
OpenAI 的 Data Controls 說明指出,個人工作區用戶可以按以下路徑關閉模型改進:
關閉後,新對話仍會保留喺聊天記錄,但唔會用作訓練或改進 ChatGPT 模型。呢個設定跟隨帳戶,而唔係只限某一部裝置。
不過要留意時間點:OpenAI 表示,選擇退出只適用於之後新增嘅對話,唔會追溯移除以前在模型改進開啟期間已提交嘅聊天內容。
OpenAI 表示,ChatGPT Business、Enterprise、Edu 以及 API Platform 嘅輸入及輸出,預設唔會用作訓練模型。相反,個人工作區內嘅 ChatGPT Free、Plus 同 Pro 用戶,模型改進資料分享預設為開啟,但可以透過 Data Controls 關閉。
呢個分別唔代表機構用戶就毋須處理資料管治或遵守公司政策;團隊仍應了解僱主規定,以及自己所屬工作區實際套用嘅設定。不過,對比一般消費者帳戶,預設資料處理方式確有重要差異。
唔係。Anthropic 的私隱政策寫明,除非用戶選擇退出,該公司可使用用戶或眾包工作人員提供嘅輸入及輸出,訓練和改進模型。 一份檢視主要 AI 供應商私隱做法嘅學術研究亦發現,Google 同 OpenAI 都有提及會由人類審閱用戶對話,以訓練或改進模型。
核心問題唔係有冇人類回饋,而係用戶是否清楚知道:對話幾時可能進入呢個流程、去識別化實際可以保護到乜同保護唔到乜,以及應該去邊度更改設定。
按 404 Media 對 Project Lily 嘅報道,一般消費者 AI 對話並非天然等於一對一保密交流。去識別化措施可以減少暴露風險,但未必能夠抹走一段充滿個人背景嘅對話中所有揭示身份或私隱嘅線索。1
輸入敏感資料之前,不妨先檢查 Settings → Data Controls → Improve the model for everyone。如果模型改進仍然開啟,應視新對話為可能合資格用於改善服務;如已關閉,OpenAI 表示新對話唔會用於該目的。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
404 Media 在 2026 年 9 月 15 日報道,OpenAI 的「Project Lily」據報聘用數百名經人力公司聘請、時薪逾 50 美元的外判人員,評核真實消費者的 ChatGPT 對話。
404 Media 在 2026 年 9 月 15 日報道,OpenAI 的「Project Lily」據報聘用數百名經人力公司聘請、時薪逾 50 美元的外判人員,評核真實消費者的 ChatGPT 對話。 審閱人員據報要概括用戶意圖、比較 4 個候選回答,再以 1 至 7 分評分,目標是令 ChatGPT 少啲機械腔、少啲一味附和,回答更自然可靠。
OpenAI 據報會移除用戶名及使用私隱篩選器,但 404 Media 發現,對話背景和記憶摘要仍可能帶有大概所在地、職業及個人經歷等敏感資料。