По данным 404 Media, в Project Lily сотни подрядчиков, которым платили более 50 долларов в час, изучали реальные чаты ChatGPT, кратко описывали цель пользователя и оценивали четыре варианта ответа по шкале от 1 до 7. В личных рабочих пространствах Free, Plus и Pro можно отключить использование новых разговоров для у...
ОпубликовалОтредактировано с помощью GPT-5.6 TerraИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Расследование 404 Media об инициативе OpenAI под внутренним названием Project Lily описывает организованную систему человеческой обратной связи на основе реальных разговоров с ChatGPT. Главный вопрос здесь не в самом факте использования данных для улучшения модели: по сведениям издания, внешние подрядчики могли читать материалы диалогов без имён пользователей, но с потенциально очень личным контекстом. 2
Согласно внутренним материалам, которые изучило 404 Media, OpenAI привлекала через кадровые компании сотни подрядчиков для проверки настоящих запросов пользователей и ответов ChatGPT. Как сообщается, оплата составляла более 50 долларов в час. Проверяющие кратко формулировали намерение пользователя, сравнивали четыре варианта ответа и выставляли им оценки по шкале от 1 до 7. 2
Целью было повысить качество ответов: сделать их менее шаблонными и «роботизированными», сократить чрезмерно человеческие заявления от имени модели, а также излишнее согласие с пользователем или лесть. Человеческая оценка давно используется при разработке ИИ, однако проверка именно реальных потребительских чатов делает вопрос приватности особенно острым. 2
404 Media пишет, что подрядчикам могли быть доступны полные фрагменты диалогов, а в некоторых заданиях — сводка памяти о пользователе (user memories summary). Имена аккаунтов, как сообщается, не показывали, однако контекст мог раскрывать примерное местоположение, профессию, прежние интересы и личные обстоятельства. 2
Это существенная разница: убрать имя — ещё не значит сделать переписку безопасной или по-настоящему анонимной. Совокупность деталей о работе, семье, состоянии здоровья или необычном жизненном событии может быть чувствительной, даже если она прямо не называет владельца аккаунта.
OpenAI называет Privacy Filter моделью для выявления и маскирования персонально идентифицируемой информации в тексте. 46
47
В комментарии к материалу о Project Lily OpenAI заявила, что удаляла имена пользователей и применяла автоматический фильтр до передачи материалов подрядчикам. Однако, по данным 404 Media, чувствительные сведения всё же могли попадать в чаты, доступные проверяющим. 2
Автоматическая маскировка хорошо распознаёт очевидные идентификаторы — например, имя, электронную почту или номер телефона. Но неявный личный контекст классифицировать гораздо сложнее: место работы, редкое сочетание обстоятельств или детали конкретного события могут многое рассказать о человеке и без прямого указания его имени.
Судя по описанным в расследовании инструкциям, оценка касалась не только фактической точности. Подрядчиков, предположительно, просили отмечать:
Отдельное внимание к угодливости важно: чат-бот, который стремится во всём поддержать пользователя, может звучать сочувственно, но не оспорить ошибочное, опасное или вредное предположение. По данным 404 Media, Project Lily должна была в том числе помочь скорректировать такое поведение модели. 2
Просьба сохранить разговор в тайне, написанная прямо в запросе, не меняет того, как работают настройки аккаунта и правила использования данных. Это лишь часть текста диалога, а не техническая команда, способная отменить настройки OpenAI.
Для личных рабочих пространств ChatGPT предусмотрена настройка Improve the model for everyone («Улучшать модель для всех»). Если она включена, чаты могут использоваться для улучшения моделей; если выключена, OpenAI заявляет, что не будет обучать модели на новых разговорах. 21
30
Для пользователей, вошедших в аккаунт, OpenAI рекомендует следующий путь:
Эта настройка действует для аккаунта целиком, а не только для одного устройства. История уже существующих чатов может остаться доступной, но, как заявляет OpenAI, новые разговоры после отключения не будут использоваться для обучения моделей. 19
30
Также в портале конфиденциальности OpenAI есть вариант Do not train on my content («Не обучать модели на моём контенте»). Компания указывает, что для задач ChatGPT и Codex достаточно выбрать либо этот вариант, либо настройку в самом ChatGPT — включать оба не требуется. 21
По данным OpenAI, в личных рабочих пространствах Free, Plus и Pro передача данных для обучения моделей включена по умолчанию, хотя от неё можно отказаться. Для ChatGPT Business, Enterprise, Edu и API Platform компания по умолчанию не использует предоставленные входные и выходные данные для обучения моделей. 23
Но это не означает, что любой корпоративный диалог автоматически лишён рисков во всех сценариях. Организациям всё равно стоит проверять настройки рабочего пространства, сроки хранения данных, механизмы доступа и собственные правила работы с конфиденциальной информацией перед загрузкой таких данных в ИИ-сервис.
Project Lily, если изложение 404 Media верно, напоминает: потребительский чат-бот следует воспринимать как сервис с настраиваемыми правилами использования данных, а не как изначально конфиденциальный канал связи. Если запрос содержит особенно чувствительную личную, юридическую, медицинскую, финансовую или коммерческую информацию, разумно отключить Improve the model for everyone ещё до начала нового разговора. 2
21
Отказ от участия в улучшении моделей касается использования новых разговоров. Это не просьба, которую можно встроить в текст запроса, и документация OpenAI не описывает эту настройку как способ отозвать уже отправленный материал. 21
30
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
По данным 404 Media, в Project Lily сотни подрядчиков, которым платили более 50 долларов в час, изучали реальные чаты ChatGPT, кратко описывали цель пользователя и оценивали четыре варианта ответа по шкале от 1 до 7.
По данным 404 Media, в Project Lily сотни подрядчиков, которым платили более 50 долларов в час, изучали реальные чаты ChatGPT, кратко описывали цель пользователя и оценивали четыре варианта ответа по шкале от 1 до 7. В личных рабочих пространствах Free, Plus и Pro можно отключить использование новых разговоров для улучшения моделей: «Настройки» → «Контроль данных» → «Улучшать модель для всех».
Для ChatGPT Business, Enterprise, Edu и API Platform OpenAI по умолчанию не использует предоставленные входные и выходные данные для обучения моделей.