404 Media raportoi 15. syyskuuta 2026, että OpenAI:n Project Lily hankkeessa sadat ulkoistetut työntekijät arvioivat oikeita kuluttajakäyttäjien ChatGPT keskusteluja, joissa voi olla arkaluonteista sisältöä.
JulkaisijaMuokattu mallilla GPT-5.6 TerraKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did the 404 Media investigation published on September 15, 2026, reveal about OpenAI’s secret “Project Lily,” including how hundreds of. Article summary: 404 Media reported that OpenAI’s internal “Project Lily” uses a large outsourced human-feedback operation to improve ChatGPT using real consumer conversations—not merely public web data or synthetic tests. The report is . Topic tags: general, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
404 Median tutkiva juttu kuvaa OpenAI:n sisäistä Project Lily -hanketta ihmispalautteeseen perustuvaksi toiminnaksi, jossa käytetään oikeita kuluttajakäyttäjien ChatGPT-keskusteluja. Vuodettujen aineistojen, esimerkkikehotteiden ja yhtiön kommenttien perusteella ulkoistetut arvioijat voivat lukea keskustelujen asiayhteyttä arvioidakseen mallin vastauksia – myös silloin, kun keskusteluissa on arkaluonteisia henkilötietoja. 1
Jos ChatGPT:tä käyttää henkilökohtaisiin, terveyttä, ihmissuhteita, oikeudellisia asioita tai työtä koskeviin kysymyksiin, olennaisin asia on tämä: chatbotille annettu pyyntö pitää asia omana tietona ei ole käyttöoikeus- eikä tietosuoja-asetus. Ratkaisevaa on, salliiko tilin asetus uusien keskustelujen käytön mallien kehittämiseen. 1
404 Media kertoi, että henkilöstövuokrausyritysten kautta palkatut, yli 50 dollarin tuntipalkkaa saavat sadat sopimustyöntekijät arvioivat suurta määrää oikeita ChatGPT-keskusteluja. Heidän tehtäviinsä kuuluu raportin mukaan:
Arviointiohjeissa keskitytään siihen, miten ChatGPT:n vastauksista tehdään laadukkaampia ja luontevampia. Arvioijia pyydetään merkitsemään muun muassa tekoälymäiseltä kuulostava ilmaisu, virheelliset faktaväitteet, liiallinen myötäily eli mielistely, turvallisuushuolia herättävä sisältö sekä vastaukset, joissa malli väittää virheellisesti omaavansa henkilökohtaisia kokemuksia tai tunteita. 1
Palautekierroksen tavoite on tehdä vastauksista vähemmän mekaanisia. Samalla palvelun kehittäminen voi tarkoittaa sitä, että ihmisillä on pääsy käyttäjäkeskustelujen sisältöön. 1
OpenAI kertoi 404 Medialle poistavansa käyttäjänimet ja käyttävänsä tietosuodatinta ennen kuin aineisto toimitetaan arvioijille. Tutkimuksessa nähtiin kuitenkin esimerkkejä, joissa arviointiaineisto sisälsi koko keskustelun asiayhteyden sekä mallin laatimia muistiyhteenvetoja. Niissä saattoi olla esimerkiksi arvioitu sijainti, ammatti ja hyvin henkilökohtaisia elämäntilanteita koskevia tietoja. 1
Ongelma liittyy asiayhteyden kautta tunnistamiseen. Nimi tai tilitunniste voidaan poistaa, mutta elämänvaiheiden, työn, maantieteellisen tiedon ja poikkeuksellisten yksityiskohtien yhdistelmä voi silti tehdä keskustelusta tunnistettavan henkilölle, joka tuntee käyttäjän – tai vähintäänkin tehdä sen paljastumisesta hyvin arkaluonteisen. 404 Median mukaan OpenAI myönsi, että suodattimien on vaikea tunnistaa epätavallisia tunnisteita sekä monitulkintaisia, asiayhteyteen sidottuja yksityisiä viittauksia. 1
ChatGPT:lle annettu ohje pitää keskustelu luottamuksellisena on keskustelun sisäinen pyyntö, ei tilin tietosuoja-asetus. Se ei syrjäytä palvelun datan käyttöä koskevia asetuksia eikä estä keskustelua päätymästä 404 Median kuvaamaan kehitys- tai arviointiprosessiin. 1
Kuluttajachatbottia ei siksi kannata pitää luottamuksellisena viestintäkanavana vain siksi, että keskustelu tuntuu henkilökohtaiselta. Jos tiedon luovuttaminen valtuutetulle arvioijalle olisi haitallista, sitä on turvallisempaa olla kirjoittamatta henkilökohtaiseen työtilaan, jossa mallin kehittäminen on käytössä.
OpenAI:n Data Controls -ohjeen mukaan henkilökohtaisen työtilan käyttäjä voi poistaa mallien kehittämisen käytöstä näin:
Kun asetus on pois päältä, uudet keskustelut säilyvät keskusteluhistoriassa, mutta niitä ei käytetä ChatGPT-mallien kouluttamiseen tai kehittämiseen. Asetus koskee tiliä, ei vain yhtä laitetta.
Ajankohdalla on merkitystä: OpenAI:n mukaan kieltäytyminen koskee uusia keskusteluja. Se ei poista takautuvasti keskusteluja, jotka on jo toimitettu palvelulle silloin, kun mallien kehittäminen oli käytössä.
OpenAI ilmoittaa, ettei se käytä ChatGPT Business-, Enterprise- tai Edu-palvelujen eikä API-alustan syötteitä ja tulosteita mallien kouluttamiseen oletusarvoisesti. Sen sijaan henkilökohtaisissa ChatGPT Free-, Plus- ja Pro-työtiloissa mallien kehittämiseen tarkoitettu datan jakaminen on oletuksena käytössä, vaikka sen voi poistaa Data Controls -asetuksista.
Tämä ero ei poista organisaatioiden omia tietosuojan ja tiedonhallinnan velvoitteita. Työntekijöiden ja opiskelijoiden kannattaa silti noudattaa organisaationsa ohjeita ja tarkistaa, mitä asetuksia omassa työtilassa sovelletaan. Kuluttajatilien oletusasetuksiin verrattuna ero on kuitenkin merkittävä.
Ei. Ihmisarviointi ei ole OpenAI:n erityispiirre. Anthropicin tietosuojakäytännön mukaan yhtiö voi kouluttaa ja kehittää mallejaan käyttäjien tai joukkoistettujen työntekijöiden toimittamilla syötteillä ja tulosteilla, ellei käyttäjä kieltäydy siitä. Suurten tekoälypalvelujen tietosuojakäytäntöjä käsitellyt akateeminen katsaus puolestaan totesi, että sekä Google että OpenAI kuvaavat käyttäjäkeskustelujen ihmisarviointia mallien koulutuksen tai kehittämisen yhteydessä.
Keskeinen kysymys ei siis ole vain se, käytetäänkö ihmispalautetta. Tärkeää on, ymmärtävätkö käyttäjät, milloin heidän keskustelunsa voivat päätyä tähän prosessiin, mitä tunnistetietojen poistaminen suojaa ja mitä se ei suojaa sekä miten asetuksia muutetaan.
404 Median kuvaama Project Lily muistuttaa, ettei kuluttajille tarkoitettu tekoälychat ole automaattisesti luottamuksellinen kahdenkeskinen keskustelu. Tunnistetietojen poistaminen voi vähentää altistumista, mutta se ei välttämättä poista kaikkia paljastavia yksityiskohtia keskustelusta, jossa on paljon henkilökohtaista asiayhteyttä. 1
Tarkista ennen arkaluonteisten tietojen jakamista ChatGPT:ssä kohta Asetukset → Data Controls → Improve the model for everyone. Jos mallien kehittäminen on käytössä, uusi keskustelu kannattaa käsitellä mahdollisesti palvelun kehityskäyttöön soveltuvana. Jos asetus on pois päältä, OpenAI ilmoittaa, ettei uusia keskusteluja käytetä tähän tarkoitukseen.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
404 Media raportoi 15. syyskuuta 2026, että OpenAI:n Project Lily hankkeessa sadat ulkoistetut työntekijät arvioivat oikeita kuluttajakäyttäjien ChatGPT keskusteluja, joissa voi olla arkaluonteista sisältöä.
404 Media raportoi 15. syyskuuta 2026, että OpenAI:n Project Lily hankkeessa sadat ulkoistetut työntekijät arvioivat oikeita kuluttajakäyttäjien ChatGPT keskusteluja, joissa voi olla arkaluonteista sisältöä. Arvioijat tiivistävät raportin mukaan käyttäjän tarkoituksen, vertailevat neljää vastausvaihtoehtoa ja antavat niille arvosanan asteikolla 1–7, jotta ChatGPT:n vastaukset olisivat luontevampia ja luotettavampia.
OpenAI:n kerrotaan poistavan käyttäjänimet ja käyttävän tietosuodatinta, mutta keskustelun asiayhteys ja muistiyhteenvedot voivat silti paljastaa henkilökohtaisia tietoja.