404 Median mukaan Project Lilyssä sadat henkilöstövuokrausyritysten kautta rekrytoidut arvioijat kävivät läpi oikeita ChatGPT keskusteluja, tiivistivät käyttäjän tarkoituksen ja pisteyttivät neljä vastausta asteikolla... Maksuttomassa, Plus ja Pro henkilötyötilassa uusien keskustelujen käytön mallien kehittämiseen v...
JulkaisijaMuokattu mallilla GPT-5.6 TerraKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation reveal about OpenAI’s secret “Project Lily,” including how hundreds of contractors paid more than $50 p. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses outside human reviewers to evaluate real ChatGPT exchanges for model improvement—not merely synthetic test data. The investigation raises a privacy concern be. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
404 Median selvityksen mukaan OpenAIlla oli sisäinen Project Lily -ohjelma, jossa oikeita ChatGPT-keskusteluja käytettiin ihmispalautteen keräämiseen. Yksityisyyden kannalta olennainen kysymys ei ole vain se, voiko keskusteluja käyttää mallien kehittämiseen: jutun mukaan ulkopuoliset arvioijat saattoivat lukea aineistoa, josta käyttäjänimi oli poistettu mutta jossa saattoi silti olla hyvin henkilökohtaista asiayhteyttä. 2
404 Median näkemien vuotaneiden aineistojen mukaan OpenAI rekrytoi henkilöstövuokrausyritysten kautta satoja sopimustyöntekijöitä arvioimaan oikeita käyttäjäkehotteita ja ChatGPT:n vastauksia. Työstä maksettiin jutun mukaan yli 50 dollaria tunnilta. Arvioijat tiivistivät käyttäjän tavoitteen, vertailivat neljää ehdokasvastausta ja antoivat niille arvosanan asteikolla 1–7. 2
Tavoitteena oli parantaa vastausten laatua: tehdä ChatGPT:stä vähemmän konemaisen kuuloinen, vähentää liian inhimillisiä väitteitä sekä hillitä liiallista myötäilyä ja imartelua. Ihmispalautetta käytetään yleisesti tekoälyn kehityksessä, mutta oikeiden kuluttajien keskustelujen käyttö tekee tietosuojakysymyksestä konkreettisen. 2
404 Median mukaan arvioijille saatettiin näyttää kokonaisia keskusteluketjuja ja joissakin tapauksissa myös yhteenveto käyttäjämuistoista. Käyttäjänimeä ei näytetty, mutta asiayhteys saattoi paljastaa esimerkiksi likimääräisen sijainnin, ammatin, aiempia kiinnostuksen kohteita ja henkilökohtaisia elämäntilanteita. 2
Nimen poistaminen ei automaattisesti tee keskustelusta käytännössä harmitonta tai anonyymia. Työ, perhetilanne, terveydentilaan liittyvät huolet tai poikkeuksellinen elämäntapahtuma voivat yhdessä olla arkaluonteisia, vaikka ne eivät suoraan paljastaisi tilinhaltijan nimeä.
OpenAI kertoo Privacy Filterin olevan malli, jonka tarkoitus on tunnistaa ja peittää tekstistä henkilötietoja. 46
47
Project Lilyä koskevassa raportoinnissa OpenAI sanoi poistavansa käyttäjänimet ja käyttävänsä automaattista suodatinta ennen kuin aineisto päätyy sopimustyöntekijöille. 404 Median mukaan arvioiduissa keskusteluissa saattoi silti näkyä arkaluonteisia yksityiskohtia. 2
Automaattinen peittäminen voi tunnistaa ilmeisiä tunnisteita, kuten nimen, sähköpostiosoitteen tai puhelinnumeron. Hienovaraisempaa, asiayhteyteen perustuvaa tunnistettavuutta on kuitenkin vaikeampi luokitella luotettavasti.
Raportin mukaan ohjeistus koski muutakin kuin pelkkää vastausten oikeellisuutta. Sopimustyöntekijöitä pyydettiin tunnistamaan muun muassa:
Myötäilyn vähentäminen on merkittävä tavoite. Käyttäjää liian halukkaasti vahvistava malli voi vaikuttaa tukevan ystävälliseltä, mutta jättää kyseenalaistamatta virheellisiä, vaarallisia tai haitallisia oletuksia. Project Lilyllä pyrittiin raportin mukaan osaltaan säätämään tällaista käytöstä. 2
Keskusteluun kirjoitettu pyyntö salassapidosta ei muuta tilin data-asetuksia. Se on osa kehotetta, ei tekninen ohje, joka ohittaisi OpenAI:n tiedonkäyttöasetukset.
Henkilökohtaisissa ChatGPT-työtiloissa OpenAI:n dokumentoitu asetus on Improve the model for everyone. Kun asetus on käytössä, keskusteluja voidaan käyttää mallien kehittämiseen. Kun se poistetaan käytöstä, OpenAI kertoo, ettei se kouluta mallejaan uusilla keskusteluilla. 21
30
Kirjautuneen käyttäjän ohje on seuraava:
Asetus koskee tiliä, ei vain yhtä laitetta. Keskusteluhistoria voi säilyä saatavilla asetuksen muuttamisen jälkeen, mutta OpenAI kertoo, ettei uusia keskusteluja käytetä mallien kouluttamiseen. 19
30
OpenAI tarjoaa tietosuoja-portaalissaan myös vaihtoehdon Do not train on my content. Yhtiön mukaan joko tämä vaihtoehto tai sovelluksen tietosuoja-asetus riittää ChatGPT:tä ja Codex-tehtäviä varten. 21
OpenAI:n mukaan henkilökohtaisissa Free-, Plus- ja Pro-työtiloissa tietojen jakaminen mallien koulutukseen on oletuksena käytössä, mutta käyttäjä voi kieltäytyä siitä. ChatGPT Business-, Enterprise- ja Edu-palveluissa sekä API Platform -palvelussa yhtiö kertoo, ettei se käytä annettuja syötteitä ja tuloksia malliensa kouluttamiseen oletusarvoisesti. 23
Tämä ei silti tee kaikesta organisaation tekoälykäytöstä automaattisesti riskitöntä. Luottamuksellista aineistoa käsittelevien organisaatioiden kannattaa tarkistaa työtilan asetukset, säilytyskäytännöt, jakamisoikeudet ja omat sisäiset ohjeensa ennen aineiston syöttämistä tekoälytyökaluun.
404 Median raportoima Project Lily muistuttaa, että kuluttajille suunnattua tekoälychattia kannattaa ajatella palveluna, jossa on erikseen määriteltäviä tiedonkäyttöasetuksia – ei lähtökohtaisesti luottamuksellisena viestikanavana. Jos kehotteessa on erittäin arkaluonteisia henkilö-, laki-, terveys-, talous- tai liikesalaisuustietoja, välitön varotoimi on poistaa Improve the model for everyone käytöstä ennen uuden keskustelun aloittamista. 2
21
Kieltäytyminen koskee OpenAI:n mukaan uusien keskustelujen käyttöä mallien kehittämiseen. Se ei ole kehotteeseen kirjoitettu pyyntö, eikä OpenAI:n ohjeistus kuvaa sitä keinoksi perua jo lähetettyä aineistoa. 21
30
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
404 Median mukaan Project Lilyssä sadat henkilöstövuokrausyritysten kautta rekrytoidut arvioijat kävivät läpi oikeita ChatGPT keskusteluja, tiivistivät käyttäjän tarkoituksen ja pisteyttivät neljä vastausta asteikolla...
404 Median mukaan Project Lilyssä sadat henkilöstövuokrausyritysten kautta rekrytoidut arvioijat kävivät läpi oikeita ChatGPT keskusteluja, tiivistivät käyttäjän tarkoituksen ja pisteyttivät neljä vastausta asteikolla... Maksuttomassa, Plus ja Pro henkilötyötilassa uusien keskustelujen käytön mallien kehittämiseen voi estää polusta Asetukset → Tietosuoja asetukset → Improve the model for everyone.
OpenAI kertoo, ettei se käytä ChatGPT Business , Enterprise , Edu tai API Platform palveluihin annettuja syötteitä ja tuloksia malliensa kouluttamiseen oletusarvoisesti.