OpenAI podle reportáží vyřadilo několik kontraktorů, kteří při hodnocení ChatGPT používali generativní AI. V projektu Lily mají stovky externích recenzentů číst skutečné konverzace s ChatGPT, shrnout záměr uživatele a hodnotit odpovědi na škále 1 až 7.
PublikovalUpraveno pomocí GPT-5.6 TerraObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: Why did OpenAI fire contractors working on Project Lily for using AI tools to evaluate anonymized ChatGPT conversations, how do its more tha. Article summary: OpenAI reportedly removed contractors who used generative AI to produce the judgments because Project Lily’s purpose is to collect independent human preferences. AI-written evaluations would turn a human-feedback pipelin. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Projekt Lily je podle 404 Media systém lidského posuzování, v němž kontraktoři hodnotí odpovědi ChatGPT, aby se jeho budoucí chování mohlo zlepšovat. Právě proto měli být z projektu vyřazeni pracovníci, kteří při hodnocení používali generativní AI: hodnota těchto dat má vycházet z nezávislého lidského úsudku. Pokud úsudek dodá model, proces už čistě neměří, co lidé skutečně preferují. 19
20
Podle popsaného postupu dostávají recenzenti skutečné prompty pro ChatGPT a někdy i celé konverzace. Shrnou záměr uživatele, porovnají kandidátní odpovědi a přidělí jim skóre na škále 1 až 7. U jednoho úkolu mohou posuzovat až čtyři odpovědi. Důraz přitom není jen na faktickou správnost, ale také na chování modelu: tón, přehnané lichocení neboli sykofancii či příliš „lidsky“ působící tvrzení. 8
19
Taková hodnocení se mohou proměnit v data o preferencích – tedy strukturovaný záznam, kterou odpověď člověk považuje v daném kontextu za lepší. Pro dolaďování chování modelu jsou užitečná jen tehdy, když jsou posudky dostatečně konzistentní, informované a nezávislé.
Projekt Lily má zahrnovat stovky externích recenzentů. Reportáže uvádějí nábor přes Crossing Hurdles a vyplácení přes Mercor; jeden z recenzentů měl dostávat více než 50 dolarů za hodinu. Zmínka o více než 10 000 kontraktorech se naproti tomu týká širší sítě hodnoticích procesů souvisejících s OpenAI, nikoli výhradně projektu Lily. 19
6
AI může být rychlým a někdy užitečným nástrojem pro interní testování. Odpovídá však na jinou otázku než člověk, který vyjadřuje vlastní preferenci. Model obvykle reprodukuje vzorce, jež si osvojil při tréninku, a může zvýhodňovat odpovědi se známým stylem, formulacemi či předpoklady.
Pokud se výstup modelu – nebo velmi příbuzného modelu – opakovaně používá k odměňování budoucích výstupů, může vzniknout zpětnovazební smyčka:
To neznamená, že každé použití AI při hodnocení model nutně zhorší. Automatizované vyhodnocování může být přínosné, pokud je ověřeno vůči lidskému úsudku a má jasně stanovené limity. Nahradit jím práci objednanou výslovně jako zdroj lidských preferencí ale oslabuje nezávislost trénovacího signálu – a to je zřejmě důvod údajného zákazu.
Vedoucí podle reportáží neměli spoléhat na detektory AI textu, například GPTZero. Místo toho měli hodnotit pracovní vzorce a výsledné texty lidským posouzením: hledat mimořádně jednotné formulace, charakteristické používání interpunkce či formátování a nepravděpodobně rychlé dokončování úkolů. 6
Takový přístup má zjevný limit: žádný z těchto znaků sám o sobě nedokazuje, že pracovník použil AI. Rychlý autor může být jednoduše zkušený a podobné formulace mohou vycházet ze společných pokynů. Věrohodný postup proto musí odlišovat podnět k prověření od důkazu dostatečného pro vyřazení člověka z projektu.
Organizace obvykle nezveřejňují podrobná kritéria proti obcházení pravidel, protože přesný seznam by se mohl stát návodem, jak kontroly obejít. Kontraktoři by mohli měnit formulace, uměle prodlužovat dobu práce nebo upravovat formát, a přitom dál přenechávat úsudek modelu.
Utajení však přináší i vlastní riziko. Pokud pracovníci nevědí, jak bylo rozhodnutí o kvalitě učiněno, hůře se proti omylům brání. Dlouhodobě funkční systém integrity proto potřebuje neveřejné metody odhalování, ale zároveň srozumitelná pravidla, zdokumentovaná rozhodnutí a smysluplnou možnost odvolání či opravy.
Mercor podle reportáží uvedl, že používání AI k provádění této hodnoticí práce porušuje pravidla a že potvrzené případy vedou k okamžitému vyřazení z příslušného projektu. Zákaz se měl týkat i širší AI asistence, včetně nástrojů pro psaní zpětné vazby nebo komentářů. 6
40
Údajný případ záměrně špatných hodnocení ukazuje širší problém: „lidská zpětná vazba“ není automaticky spolehlivá jen proto, že ji odeslal člověk. Recenzent může spěchat, nepochopit hodnoticí pravidla, optimalizovat práci na objem, jednat ve zlé víře nebo se snažit obejít neprůhledný systém kontroly kvality.
Jde o problém pobídek stejně jako o technickou otázku. Vývojář modelu potřebuje uvážlivé a poctivé posudky, které povedou k lepšímu chování pro skutečné uživatele. Kontraktor ale může být odměňován hlavně za rychlost, dokončení úkolů či vyhnutí se zamítnutí. Když se tyto motivace rozcházejí, mohou být data šumová nebo systematicky zkreslená.
Lidské posuzování zůstává důležité tam, kde je úsudek závislý na kontextu, subjektivní nebo obtížně automaticky ověřitelný. Nejlépe ale funguje jako systém vzájemných kontrol, nikoli jako prostý proud jednotlivých známek. Mezi praktické pojistky patří:
Závěr je jednoduchý: trénování podle preferencí je jen tak důvěryhodné, jako je proces, který tyto preference vytváří. Lidský recenzent není sám o sobě zárukou kvality a hodnocení vytvořené AI nemůže bez dalšího nahradit nezávislou lidskou zpětnou vazbu, má-li systém zjišťovat, čeho si lidé skutečně cení.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI podle reportáží vyřadilo několik kontraktorů, kteří při hodnocení ChatGPT používali generativní AI.
OpenAI podle reportáží vyřadilo několik kontraktorů, kteří při hodnocení ChatGPT používali generativní AI. V projektu Lily mají stovky externích recenzentů číst skutečné konverzace s ChatGPT, shrnout záměr uživatele a hodnotit odpovědi na škále 1 až 7.
Případ ukazuje slabinu systémů lidské zpětné vazby: lidské hodnocení není automaticky kvalitní ani nezávislé.