404 Media 于 2026 年 9 月 15 日报道称,OpenAI 的“Project Lily”安排数百名通过人力派遣公司雇用的外包人员评估真实消费者 ChatGPT 对话,其中可能包含敏感上下文。[1] 审核员据报需要概括用户意图、对比 4 个候选回复,并以 1 至 7 分评分,目标是让 ChatGPT 更自然、少些机械感和过度迎合,并提升可靠性。[1] OpenAI 据报会移除用户名并使用隐私过滤器,但 404 Media 发现,对话上下文及记忆摘要仍可能包含大致所在地、职业和个人处境等敏感信息。[1]
发布者使用 GPT-5.6 Terra 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Media 对 OpenAI 内部“Project Lily”的调查显示,用于人工反馈的材料可能来自真实的消费者 ChatGPT 对话。该媒体根据泄露材料、提示词示例及其查阅到的声明报道称,外包审核员可阅读对话上下文,以评估模型回复;这些内容有时会涉及高度私人的信息。1
对用 ChatGPT 讨论个人困扰、健康、感情、法律或工作问题的人来说,关键区别在于:在对话里要求机器人“保密”,并不是账户层面的隐私设置。真正相关的是,账户是否允许新的对话被用于改进模型。1
404 Media 报道称,数百名经人力派遣公司雇用、时薪超过 50 美元的外包人员,会审核大量真实 ChatGPT 对话。他们的任务据报包括:
据报的评估标准,着重于提升 ChatGPT 回复的自然度和质量。审核员会标记带有明显“AI 腔”的措辞、事实错误、过度认同或迎合用户的表达、安全风险,以及模型错误暗示自己拥有个人经历或情感的说法。1
这套反馈机制的目标,是让回答听起来更自然、少些机械感;但这也意味着,改善质量的过程可能涉及人工接触用户对话的实质内容。1
OpenAI 向 404 Media 表示,在材料送交审核员前会移除用户名,并应用“隐私过滤器”(Privacy Filter)。不过,该调查发现,审核材料中仍可能包含完整对话上下文及模型生成的记忆摘要;这些摘要据报可能写有大致所在地、职业和极为私人的生活处境。1
问题在于“情境识别”。姓名或账户标识符即使被删除,人生事件、工作细节、地理信息或罕见描述的组合,仍可能让认识当事人的人辨认出来;即便无法对应到具体身份,这类内容本身也可能非常敏感。404 Media 报道称,OpenAI 承认,过滤器对不常见的标识符,以及含义依赖语境、表述模糊的私人信息,可能较难准确识别。1
让 ChatGPT 对某段讨论保密,只是对话里的指令,并非账户的数据访问控制。它不能覆盖服务的数据使用设置,也不能阻止对话被选入 404 Media 所描述的模型改进流程。1
因此,不应因为聊天感觉私密,就把面向消费者的聊天机器人当成保密渠道。若某项信息即使仅被获授权审核员看到也会造成风险,更稳妥的做法是:不要在已启用模型改进的个人工作区输入这些内容。
OpenAI 的“数据控制”(Data Controls)说明称,个人工作区用户可按以下路径关闭模型改进:
关闭后,新的对话仍会保留在聊天记录中,但不会被用于训练或改进 ChatGPT 模型。该设置与账户绑定,不局限于某一台设备。
时间点很重要:OpenAI 表示,退出仅适用于新的对话,不会追溯撤回此前在模型改进开启期间已提交的聊天内容。
OpenAI 表示,默认不会将 ChatGPT Business、Enterprise、Edu 或 API Platform 的输入和输出用于训练模型。与之相对,个人工作区中的 ChatGPT 免费版、Plus 和 Pro 用户,默认启用模型改进数据共享,但可在“数据控制”中退出。
这并不意味着组织无需履行内部数据治理义务。团队仍应遵守雇主政策,并核实自己所在工作区的具体设置;不过,这确实是与消费者个人聊天默认处理方式的重要区别。
并不是。人工审核并非 OpenAI 独有。Anthropic 的隐私政策称,除非用户选择退出,其可使用用户或众包工作人员提供的输入与输出训练和改进模型。 一项对主要 AI 服务商隐私实践的学术梳理也指出,Google 和 OpenAI 均在相关政策中提及,为训练或改进模型而进行的用户聊天人工审核。
更值得关注的问题,不是人工反馈是否存在,而是用户是否清楚:自己的对话何时可能进入这类流程、去标识化能保护什么又无法保护什么,以及如何修改适用设置。
按 404 Media 的报道,“Project Lily”提醒人们:消费者 AI 聊天并非天然是一对一的保密交流。去标识化措施或许能降低暴露风险,却未必能从充满个人背景的对话中移除所有可揭示身份或隐私的细节。1
在向 ChatGPT 输入敏感信息前,请查看 设置 → 数据控制 → 为所有人改进模型。如果模型改进处于开启状态,应将新的聊天视为可能符合服务改进使用条件;如果关闭,OpenAI 表示新的聊天不会被用于该目的。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
404 Media 于 2026 年 9 月 15 日报道称,OpenAI 的“Project Lily”安排数百名通过人力派遣公司雇用的外包人员评估真实消费者 ChatGPT 对话,其中可能包含敏感上下文。[1]
404 Media 于 2026 年 9 月 15 日报道称,OpenAI 的“Project Lily”安排数百名通过人力派遣公司雇用的外包人员评估真实消费者 ChatGPT 对话,其中可能包含敏感上下文。[1] 审核员据报需要概括用户意图、对比 4 个候选回复,并以 1 至 7 分评分,目标是让 ChatGPT 更自然、少些机械感和过度迎合,并提升可靠性。[1]
OpenAI 据报会移除用户名并使用隐私过滤器,但 404 Media 发现,对话上下文及记忆摘要仍可能包含大致所在地、职业和个人处境等敏感信息。[1]