404 Media uvádí, že v projektu Lily stovky externích spolupracovníků za více než 50 dolarů za hodinu hodnotily skutečné chaty, shrnovaly záměr uživatele a známkovaly čtyři odpovědi na škále 1 až 7. U osobních účtů Free, Plus a Pro lze využití nových chatů pro zlepšování modelů vypnout v nabídce Nastavení → Ovládání...
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Vyšetřování webu 404 Media popisuje interní iniciativu OpenAI s názvem Project Lily, v níž měli externí hodnotitelé pracovat se skutečnými konverzacemi uživatelů ChatGPT. Nejde tedy jen o obecnou otázku, zda se chaty používají pro vylepšování modelu: podle reportáže mohli smluvní pracovníci číst materiál bez uživatelských jmen, avšak stále s velmi osobním kontextem. 2
Podle interních podkladů, které 404 Media prostudovalo, OpenAI najímala přes personální agentury stovky externích spolupracovníků. Odměna měla přesahovat 50 dolarů za hodinu. Jejich úkolem bylo shrnout, co uživatel zamýšlel, porovnat čtyři možné odpovědi ChatGPT a ohodnotit je na škále 1 až 7. 2
Cílem mělo být zkvalitnit odpovědi: aby chatbot působil přirozeněji a méně šablonovitě, méně se stylizoval do člověka a méně uživateli bezvýhradně přitakával nebo lichotil. Zapojení lidské zpětné vazby je v rozvoji AI běžné; citlivou otázkou je zde použití reálných spotřebitelských konverzací. 2
404 Media uvádí, že hodnotitelé mohli dostat celé výměny zpráv a v některých případech také shrnutí uživatelských vzpomínek (user memories summary). Uživatelské jméno se nezobrazovalo, dostupný kontext ale mohl prozradit přibližnou polohu, profesi, dřívější zájmy nebo osobní situaci. 2
Právě v tom je podstatný rozdíl mezi odstraněním jména a skutečnou anonymitou. Kombinace informací o práci, rodině, zdravotních potížích či neobvyklé životní události může být citlivá, i když přímo neodhaluje jméno držitele účtu.
OpenAI popisuje svůj Privacy Filter jako model určený k rozpoznávání a redigování osobních údajů v textu. 46
47
V souvislosti s Project Lily společnost uvedla, že před předáním materiálů externistům odstraňuje uživatelská jména a používá automatický filtr. Reportáž 404 Media však říká, že se citlivé údaje mohly v hodnocených konverzacích objevit i navzdory těmto opatřením. 2
Automatická redakce může rozpoznat zjevné údaje, například jméno, e-mailovou adresu nebo telefonní číslo. Mnohem hůře ale zachytí nepřímé identifikátory a souvislosti, které mohou člověka vystavit odhalení nebo prozradit jeho intimní okolnosti.
Pokyny podle reportáže neřešily jen faktickou správnost. Externisté měli upozorňovat mimo jiné na:
Důraz na takzvanou sykofancii — tedy přehnanou ochotu uživateli přitakat — je důležitý. Model, který neustále potvrzuje uživatelovy názory, může působit vstřícně, ale nemusí korigovat nesprávné, rizikové nebo škodlivé předpoklady. Project Lily měl podle reportáže pomáhat toto chování omezit. 2
Prosba o utajení napsaná přímo do promptu nemění pravidla nakládání s daty ani nepřepisuje nastavení účtu. Je to pouze součást obsahu konverzace, nikoli technický pokyn, který by omezil použití dat.
Pro osobní pracovní prostory ChatGPT je rozhodující ovládací prvek „Improve the model for everyone“. Je-li zapnutý, mohou být chaty použity ke zlepšování modelů. Je-li vypnutý, OpenAI uvádí, že nebude trénovat na nových konverzacích. 21
30
Přihlášení uživatelé mají podle pokynů OpenAI postupovat takto:
Toto nastavení se váže k účtu, nikoli k jednomu zařízení. Historie dřívějších chatů vám může zůstat k dispozici, ale nové konverzace se po vypnutí nemají používat k trénování modelů. 19
30
Alternativou je volba „Do not train on my content“ na portálu ochrany soukromí OpenAI. Společnost uvádí, že pro úlohy v ChatGPT a Codexu stačí použít jednu z těchto dvou možností. 21
U osobních pracovních prostorů Free, Plus a Pro je podle OpenAI sdílení dat pro trénování modelů ve výchozím nastavení zapnuté, uživatel se ale může odhlásit. U ChatGPT Business, Enterprise, Edu a API Platform OpenAI standardně nepoužívá poskytnuté vstupy a výstupy k trénování svých modelů. 23
Ani u firemního účtu to samo o sobě neznamená, že lze bez dalšího vkládat jakýkoli důvěrný obsah. Organizace by měly prověřit vlastní nastavení pracovního prostoru, uchovávání dat, pravidla sdílení i interní postupy.
Project Lily, jak jej popisuje 404 Media, je připomínkou, že spotřebitelský chat s AI není automaticky důvěrným komunikačním kanálem. Před zadáním vysoce citlivých osobních, zdravotních, právních, finančních nebo firemních informací je vhodné nejprve vypnout „Improve the model for everyone“. 2
21
Odhlášení se týká používání nových konverzací ke zlepšování modelů. Nejde o instrukci vloženou do promptu a dokumentace OpenAI jej nepopisuje jako způsob, jak vzít zpět již odeslaný obsah. 21
30
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
404 Media uvádí, že v projektu Lily stovky externích spolupracovníků za více než 50 dolarů za hodinu hodnotily skutečné chaty, shrnovaly záměr uživatele a známkovaly čtyři odpovědi na škále 1 až 7.
404 Media uvádí, že v projektu Lily stovky externích spolupracovníků za více než 50 dolarů za hodinu hodnotily skutečné chaty, shrnovaly záměr uživatele a známkovaly čtyři odpovědi na škále 1 až 7. U osobních účtů Free, Plus a Pro lze využití nových chatů pro zlepšování modelů vypnout v nabídce Nastavení → Ovládání dat → „Improve the model for everyone“.
U produktů ChatGPT Business, Enterprise, Edu a API Platform OpenAI podle své dokumentace standardně nepoužívá dodané vstupy a výstupy k trénování modelů.