404 Media podało, że w ramach Project Lily setki kontraktorów, którym płacono podobno ponad 50 dolarów za godzinę, oceniały prawdziwe rozmowy z ChatGPT i cztery warianty odpowiedzi w skali od 1 do 7. W osobistej przestrzeni Free, Plus lub Pro wyłącz opcję Ustawienia → Kontrola danych → „Improve the model for everyon...
Opublikowane przezEdytowane za pomocą GPT-5.6 TerraObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
404 Media opisało wewnętrzną inicjatywę OpenAI o nazwie Project Lily, w której do oceny prawdziwych rozmów z ChatGPT mieli być angażowani ludzie. Sedno problemu z prywatnością nie polega tylko na tym, że czaty mogą służyć ulepszaniu modelu. Według reportażu zewnętrzni kontraktorzy mogli czytać materiał pozbawiony nazw użytkowników, ale nadal zawierający bardzo osobisty kontekst. 2
Z materiałów, do których dotarło 404 Media, wynika, że OpenAI rekrutowało przez firmy pośredniczące setki kontraktorów do przeglądania rzeczywistych pytań użytkowników i odpowiedzi ChatGPT. Stawka miała przekraczać 50 dolarów za godzinę. Recenzenci mieli streszczać intencję użytkownika, porównywać cztery proponowane odpowiedzi i oceniać je w skali od 1 do 7. 2
Celem miała być poprawa jakości odpowiedzi — między innymi sprawienie, by ChatGPT brzmiał mniej mechanicznie, rzadziej sugerował ludzkie emocje lub doświadczenia oraz nie był przesadnie potakujący i schlebiający użytkownikowi. Wykorzystanie ludzkiej informacji zwrotnej w rozwoju AI nie jest czymś nowym, lecz używanie w tym celu realnych rozmów konsumentów bezpośrednio rodzi pytania o prywatność. 2
404 Media podało, że recenzenci mogli otrzymywać całe wymiany wiadomości, a czasem także podsumowanie pamięci użytkownika. Nazwy użytkowników nie miały być widoczne, ale kontekst mógł wskazywać przybliżoną lokalizację, zawód, wcześniejsze zainteresowania lub osobistą sytuację. 2
To istotna różnica: usunięcie imienia czy nazwy konta nie oznacza automatycznie, że rozmowa staje się w praktyce niegroźna lub anonimowa. Zestaw szczegółów dotyczących pracy, rodziny, zdrowia albo nietypowego wydarzenia może być wrażliwy, nawet jeśli nie wskazuje bezpośrednio konkretnego właściciela konta.
OpenAI podaje, że jego Privacy Filter to model służący do wykrywania i maskowania danych osobowych w tekście. 46
47
W odniesieniu do Project Lily firma przekazała, że usuwa nazwy użytkowników i stosuje automatyczny filtr przed przekazaniem materiału kontraktorom. Jednocześnie 404 Media informowało, że mimo tych środków w ocenianych rozmowach mogły pozostać dane wrażliwe. 2
To pokazuje ograniczenie automatycznej redakcji danych. System może wykryć oczywiste identyfikatory, takie jak imię i nazwisko, adres e-mail czy numer telefonu, ale znacznie trudniej niezawodnie rozpoznać identyfikujący kontekst wynikający z kombinacji pozornie zwyczajnych informacji.
Z opisu zasad pracy wynika, że kontraktorzy oceniali nie tylko poprawność odpowiedzi. Mieli także wskazywać m.in.:
Wątek nadmiernej uległości jest ważny. Model, który zbyt chętnie przytakuje, może sprawiać wrażenie wspierającego, ale nie zakwestionuje błędnych, ryzykownych lub szkodliwych założeń użytkownika. Project Lily miał służyć między innymi dostrajaniu takiego zachowania. 2
Prośba o zachowanie tajemnicy wpisana w wiadomości nie zmienia zasad przetwarzania danych na koncie. To po prostu treść promptu, a nie techniczna dyspozycja, która zastępuje ustawienia dotyczące wykorzystania danych przez OpenAI.
Dla osobistych przestrzeni ChatGPT właściwą kontrolką jest „Improve the model for everyone”. Gdy jest włączona, rozmowy mogą być wykorzystywane do ulepszania modeli. Po jej wyłączeniu OpenAI deklaruje, że nie będzie trenować modeli na nowych rozmowach. 21
30
Dla użytkownika zalogowanego do ChatGPT ścieżka jest następująca:
To ustawienie dotyczy całego konta, a nie jednego urządzenia. Historia dotychczasowych czatów może pozostać dostępna, ale OpenAI podaje, że nowe rozmowy nie będą używane do trenowania modeli. 19
30
Firma udostępnia też w swoim portalu prywatności opcję „Do not train on my content”. Według OpenAI, w przypadku zadań w ChatGPT i Codex wystarczy skorzystać z jednej z tych dwóch metod. 21
OpenAI wskazuje, że w osobistych przestrzeniach Free, Plus i Pro udostępnianie danych do trenowania modeli jest domyślnie włączone, choć użytkownik może z niego zrezygnować. W przypadku ChatGPT Business, Enterprise, Edu oraz platformy API firma deklaruje, że domyślnie nie wykorzystuje przekazanych danych wejściowych i wyjściowych do trenowania modeli. 23
Nie oznacza to jednak, że każda firmowa rozmowa jest automatycznie wolna od wszelkiego ryzyka w każdym zastosowaniu. Organizacje nadal powinny sprawdzić ustawienia przestrzeni roboczej, zasady retencji danych, kontrolę udostępniania oraz własne procedury przed wprowadzaniem poufnych materiałów do narzędzi AI.
Project Lily, w opisie 404 Media, przypomina, że konsumencki czat AI należy traktować jako usługę z konfigurowalnymi zasadami wykorzystania danych — nie jako kanał z definicji poufny. Jeśli prompt zawiera szczególnie wrażliwe dane osobowe, medyczne, prawne, finansowe albo informacje stanowiące tajemnicę firmy, najprostszym krokiem jest wyłączenie opcji „Improve the model for everyone” przed rozpoczęciem nowej rozmowy. 2
21
Rezygnacja z tego wykorzystania dotyczy nowych rozmów. Nie jest poleceniem wpisywanym do promptu, a dokumentacja OpenAI nie opisuje jej jako sposobu na wycofanie treści już przesłanych. 21
30
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
404 Media podało, że w ramach Project Lily setki kontraktorów, którym płacono podobno ponad 50 dolarów za godzinę, oceniały prawdziwe rozmowy z ChatGPT i cztery warianty odpowiedzi w skali od 1 do 7.
404 Media podało, że w ramach Project Lily setki kontraktorów, którym płacono podobno ponad 50 dolarów za godzinę, oceniały prawdziwe rozmowy z ChatGPT i cztery warianty odpowiedzi w skali od 1 do 7. W osobistej przestrzeni Free, Plus lub Pro wyłącz opcję Ustawienia → Kontrola danych → „Improve the model for everyone”, aby nowe rozmowy nie były wykorzystywane przez OpenAI do ulepszania modeli.
Według OpenAI dane wejściowe i wyjściowe w ChatGPT Business, Enterprise, Edu oraz na platformie API nie są domyślnie używane do trenowania modeli.