404 Mediaは2026年9月15日、OpenAIの「Project Lily」で、時給50ドル超とされる数百人の外部委託者が実際の消費者向けChatGPT会話を評価していると報じた。[1] 評価担当者はユーザーの意図を要約し、4つの回答候補を比較して1〜7で採点。AIらしすぎる表現、過度な迎合、事実誤認などを指摘するとされる。[1] OpenAIはユーザー名の削除とプライバシーフィルターの適用を説明した一方、会話の文脈やメモリー要約には、居住地の目安、職業、個人的事情が残る可能性があると報じられた。[1]
公開者GPT-5.6 Terra で編集GPT Image 2 で画像を生成
研究の答え

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Mediaの調査報道によると、OpenAIの社内プロジェクト「Project Lily」では、実際の消費者向けChatGPT会話を用いた人間による評価が行われているとされます。流出した内部資料、実例のプロンプト、同社の説明を基にした報道では、外部委託の担当者が会話の前後関係を読み、モデルの回答を評価する場合があるといいます。そこには、利用者のセンシティブな個人情報が含まれることもあり得ます。1
健康、家族・交際、法律、仕事上の悩みなどをChatGPTに相談する人にとって重要なのは、会話内で「この話は内緒にして」と書いても、それはアカウントのデータ利用設定ではないという点です。新しい会話をモデル改善に使わせるかどうかは、ChatGPTのデータコントロールで決まります。1
404 Mediaは、人材会社を通じて採用され、時給50ドル超とされる数百人の委託者が、大量の実際のChatGPT会話を確認していると報じました。担当業務には、次のような内容が含まれるとされています。
評価基準には、機械的で不自然な「AIらしい」言い回し、事実と異なる説明、根拠なく利用者に同調・迎合する表現、安全性の問題、そしてAIが人間の経験や感情を持つかのように述べる表現などが含まれるといいます。1
この種のフィードバックは、ChatGPTの回答をより自然で信頼できるものにする目的があります。一方で、品質改善の工程に人間が会話内容へアクセスする可能性がある、ということでもあります。1
OpenAIは404 Mediaに対し、評価担当者へ渡す前にユーザー名を削除し、プライバシーフィルターを適用していると説明しました。しかし同メディアは、評価用資料に会話全体の文脈や、モデルが生成したメモリーの要約が含まれる例を確認したと報じています。そこには居住地のおおまかな情報、職業、非常に個人的な事情などが記されていたとされます。1
氏名やアカウントIDを取り除いても、出来事の経緯、仕事の内容、地域、固有の表現が組み合わされば、本人を知る人には誰の話か推測できることがあります。氏名が分からなくても、開示されたくない内容であること自体は変わりません。404 Mediaによれば、OpenAIも、珍しい識別情報や文脈に依存する曖昧な私的言及は、フィルターが見逃すことがあると認めました。1
ChatGPTに秘密保持を頼む文言は、会話中の指示であって、サービス上のアクセス制御ではありません。アカウントで選択しているデータ利用設定を上書きしたり、報道で示された改善ワークフローの対象から外したりする機能ではありません。1
個人向けチャットを、医師・弁護士・カウンセラーとの守秘が前提の相談窓口のように扱うのは避けるべきです。認められた評価担当者に読まれるだけでも困る情報なら、モデル改善を有効にした個人用ワークスペースには入力しないほうが安全です。
OpenAIのデータコントロールに関する案内では、個人用ワークスペースの利用者は、次の手順でモデル改善への利用を停止できます。
この設定をオフにすると、会話履歴には新しいチャットが残る一方で、OpenAIによれば、それらはChatGPTモデルの学習・改善には使用されません。設定は端末ごとではなく、アカウント全体に適用されます。
ただし、変更は新しい会話に対して適用されます。モデル改善が有効だった期間にすでに送信した会話が、さかのぼって対象外になるわけではありません。
OpenAIは、ChatGPT Business、Enterprise、Edu、およびAPI Platformで扱う入力・出力について、原則としてモデル学習に使用しないと案内しています。一方、個人用ワークスペースのChatGPT Free、Plus、Proでは、モデル改善のためのデータ共有が初期設定で有効ですが、データコントロールから停止できます。
もちろん、組織アカウントなら何を入力してもよいという意味ではありません。社内規程、取引先との契約、個別のワークスペース設定は別途確認が必要です。それでも、消費者向けの個人アカウントとは初期設定上の扱いが異なる点は重要です。
人間の評価担当者を通じてAIを改善する手法は、OpenAIに特有のものではありません。Anthropicのプライバシーポリシーは、利用者またはクラウドワーカーが提供した入力・出力を、利用者がオプトアウトしない限りモデルの訓練・改善に使う場合があると説明しています。
また、主要AI事業者のプライバシー慣行を検討した学術レビューは、GoogleとOpenAIの両社が、モデルの訓練または改善を目的としたユーザーチャットの人間による確認に言及していると指摘しています。
問われるべきなのは、人間のフィードバックが存在するかだけではありません。自分の会話がいつその工程に入り得るのか、匿名化で何が守られ何が残り得るのか、そして設定をどう変更できるのかを、利用者が理解できているかが重要です。
404 Mediaが報じた「Project Lily」は、消費者向けAIチャットが自動的に完全な一対一の秘匿コミュニケーションになるわけではないことを示しています。匿名化は露出を減らす対策になり得ますが、個人的な文脈が濃い会話から、すべての手がかりを取り除けるとは限りません。1
機微な情報を入力する前に、**設定 → データコントロール → 「すべての人のためにモデルを改善する」**を確認しましょう。有効なら、新しい会話はサービス改善に利用される可能性があるものとして扱うべきです。オフであれば、OpenAIは新しい会話をその目的には使用しないと説明しています。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
404 Mediaは2026年9月15日、OpenAIの「Project Lily」で、時給50ドル超とされる数百人の外部委託者が実際の消費者向けChatGPT会話を評価していると報じた。[1]
404 Mediaは2026年9月15日、OpenAIの「Project Lily」で、時給50ドル超とされる数百人の外部委託者が実際の消費者向けChatGPT会話を評価していると報じた。[1] 評価担当者はユーザーの意図を要約し、4つの回答候補を比較して1〜7で採点。AIらしすぎる表現、過度な迎合、事実誤認などを指摘するとされる。[1]
OpenAIはユーザー名の削除とプライバシーフィルターの適用を説明した一方、会話の文脈やメモリー要約には、居住地の目安、職業、個人的事情が残る可能性があると報じられた。[1]