За даними 404 Media, сотні підрядників, яким нібито платили понад 50 доларів США за годину, оцінювали реальні діалоги ChatGPT: узагальнювали намір користувача та виставляли оцінки чотирьом варіантам відповіді за шкало... У персональних робочих просторах Free, Plus і Pro вимкніть «Покращувати модель для всіх» у «Нала...
ОпублікувавВідредаговано за допомогою GPT-5.6 TerraЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Розслідування 404 Media щодо внутрішньої ініціативи OpenAI під назвою Project Lily описує організовану програму людського зворотного зв’язку, побудовану на реальних розмовах із ChatGPT. Питання приватності полягає не лише в тому, що чати можуть використовуватися для вдосконалення моделей: за даними видання, зовнішні підрядники могли читати матеріали без імен користувачів, але з дуже особистим контекстом. 2
За витоками матеріалів, які переглянуло 404 Media, OpenAI залучала через кадрові фірми сотні підрядників для перевірки реальних запитів користувачів і відповідей ChatGPT. Як повідомляється, така робота оплачувалася більш ніж у 50 доларів США за годину. Рецензенти стисло описували намір користувача, порівнювали чотири варіанти відповіді та оцінювали їх за шкалою від 1 до 7. 2
Заявленою метою було покращити якість відповідей: зробити ChatGPT менш шаблонним, зменшити надто «людські» твердження та надмірне погоджування або лестощі. Людський зворотний зв’язок давно використовують у розробці ШІ, однак робота саме з реальними розмовами споживачів робить питання конфіденційності особливо гострим. 2
404 Media повідомило, що рецензентам могли надходити повні діалоги, а в деяких випадках — зведення пам’яті про користувача (user memories summary). Імена користувачів, за даними звіту, не показувалися. Водночас наявний контекст міг розкривати приблизне місце перебування, професію, попередні інтереси та особисті обставини. 2
Це важлива різниця: прибрати ім’я — не означає зробити розмову безпечною або фактично анонімною. Сукупність деталей про роботу, родину, стан здоров’я чи унікальну подію може бути чутливою навіть без прямої ідентифікації власника облікового запису.
OpenAI називає Privacy Filter моделлю, призначеною для виявлення та редагування персонально ідентифікованої інформації в тексті. 46
47
У матеріалі про Project Lily компанія OpenAI заявила, що перед передаванням матеріалів підрядникам видаляла імена користувачів і застосовувала автоматизований фільтр. Але, за повідомленням 404 Media, чутливі деталі все одно могли залишатися в розмовах, доступних для перевірки. 2
Це показує межі автоматичного редагування. Система може розпізнати очевидні ідентифікатори — наприклад, ім’я, електронну адресу чи номер телефону, — тоді як непрямий контекст значно складніше надійно класифікувати.
За даними розслідування, настанови для підрядників стосувалися не тільки фактичної правильності. Їм нібито пропонували виявляти, зокрема:
Акцент на надмірному погоджуванні показовий. Модель, яка надто охоче підтверджує слова людини, може здаватися підтримувальною, але не заперечувати хибні, ризиковані чи шкідливі припущення. Як повідомляє 404 Media, Project Lily частково мав допомогти налаштувати саме таку поведінку. 2
Прохання зберегти таємницю, написане в самому запиті, не змінює налаштувань використання даних для облікового запису. Це лише частина тексту чату, а не технічна команда, яка може скасувати правила OpenAI.
Для персональних робочих просторів ChatGPT документований інструмент контролю має назву «Покращувати модель для всіх» (Improve the model for everyone). Якщо він увімкнений, чати можуть використовуватися для поліпшення моделей; якщо вимкнений, OpenAI повідомляє, що не навчатиме моделі на нових розмовах. 21
30
Для користувачів, які увійшли в обліковий запис, OpenAI наводить такий шлях:
Це налаштування застосовується до облікового запису, а не до окремого пристрою. Історія чатів може залишатися доступною після вимкнення, проте OpenAI заявляє, що нові розмови не використовуватимуться для навчання її моделей. 19
30
Також OpenAI пропонує опцію «Не навчати на моєму контенті» (Do not train on my content) у своєму порталі конфіденційності. Компанія зазначає, що для завдань ChatGPT і Codex достатньо або цього вибору, або налаштування в розділі Data Controls. 21
OpenAI повідомляє, що в персональних робочих просторах Free, Plus і Pro передавання даних для навчання моделей увімкнене за замовчуванням, хоча користувач може відмовитися. Для ChatGPT Business, Enterprise, Edu та API Platform компанія заявляє, що за замовчуванням не використовує надані вхідні й вихідні дані для навчання моделей. 23
Втім, це не означає, що будь-яка корпоративна розмова автоматично позбавлена ризиків у всіх сценаріях. Організаціям варто перевіряти налаштування робочого простору, строки зберігання даних, параметри спільного доступу та внутрішні правила, перш ніж передавати до ШІ-інструментів конфіденційні матеріали.
Project Lily, як його описало 404 Media, нагадує: споживчі чати зі ШІ слід сприймати як сервіс із налаштуваннями використання даних, а не як канал із вбудованою конфіденційністю. Якщо запит містить особливо чутливу особисту, юридичну, медичну, фінансову або комерційну інформацію, найпростіший крок — вимкнути «Покращувати модель для всіх» до початку нової розмови. 2
21
Відмова від використання даних стосується того, як OpenAI використовує нові розмови для поліпшення моделей. Це не інструкція, яку можна додати всередину промпту, і документація OpenAI не описує цю опцію як спосіб відкликати вже надіслані матеріали. 21
30
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
За даними 404 Media, сотні підрядників, яким нібито платили понад 50 доларів США за годину, оцінювали реальні діалоги ChatGPT: узагальнювали намір користувача та виставляли оцінки чотирьом варіантам відповіді за шкало...
За даними 404 Media, сотні підрядників, яким нібито платили понад 50 доларів США за годину, оцінювали реальні діалоги ChatGPT: узагальнювали намір користувача та виставляли оцінки чотирьом варіантам відповіді за шкало... У персональних робочих просторах Free, Plus і Pro вимкніть «Покращувати модель для всіх» у «Налаштуваннях» → «Керування даними», щоб нові розмови не використовувалися для поліпшення моделей.
За інформацією OpenAI, дані з ChatGPT Business, Enterprise, Edu та API Platform за замовчуванням не використовуються для навчання моделей.