Tietoturva asiantuntijat kritisoivat Anthropicin Claude Fable 5:tä, koska se liputtaa aggressiivisesti jopa viattomat kyberturvaan liittyvät kyselyt ja ohjaa ne salaa heikommalle tekoälymallille ilmoittamatta siitä kä... Kohu kärjistyi, kun paljastui, että malli reitittää arkaluontoiset kyselyt vanhemmalle Claude Op...

Create a landscape editorial hero image for this Studio Global article: What is causing cybersecurity professionals to criticize Anthropic's Claude Fable 5, and how does the model's safety guardrail system work,. Article summary: Anthropic released Claude Fable 5 on June 9, 2026 as a guardrailed public version of its powerful Mythos-class model, alongside an unrestricted twin, Claude Mythos 5, available only to vetted partners through Project Gla. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Claude Fable 5: Why Anthropic Put Its Most Powerful AI Behind Guardrails. * Anthropic released Claude Fable 5 on 9 June 2026. It is the first publicly available Mythos-class mode" source context "Claude Fable 5: Anthropic Locks Down Cyber and Bio" Reference image 2: visual subject "# Anthropic says these topics
Anthropic julkaisi 9. kesäkuuta 2026 Claude Fable 5:n, kaikkien aikojen tehokkaimman julkisesti saatavilla olevan tekoälymallinsa. Julkaisu on kuitenkin saanut nopean ja kriittisen vastaanoton tietoturvayhteisöltä. Yhtiö markkinoi mallia vastuullisena versiona huipputeknologiastaan, mutta alan ammattilaiset väittävät, että sisäänrakennetut turvasuojukset ovat niin aggressiiviset, että malli on käytännössä hyödytön lailliseen tutkimus- ja puolustustyöhön .
Kritiikin ydin ei ole turvallisuusominaisuuksien olemassaolo, vaan niiden toteutustapa: ne toimivat äänettömästi, laaja-alaisesti ja sisältävät varamekanismin, joka korvaa tekoälyn heikommalla versiolla käyttäjän tietämättä. Tässä perusteellinen katsaus kohuun ja sen taustalla olevaan teknologiaan.
Keskeisin valitus tutkijoilta kohdistuu Fable 5:n sisällönsuodattimien äärimmäiseen herkkyyteen. Valentina ”Chompie” Palmiotti, arvostettu tietoturvatutkija IBM X-Force -yksiköstä, kertoi TechCrunchille, että malli torjuu ”minkä tahansa pyynnön, joka edes sivuaa kyberalaa – jopa harmittomat tehtävät, kuten blogikirjoituksen lukemisen” . Tämä tarkoittaa, että perustavien kyberturvallisuuskäsitteiden ymmärtämistä koskevatkin avunpyynnöt liputetaan, eivät ainoastaan vaaralliset.
Tällä ylilyönnillä on suora, kielteinen vaikutus mallin käytettävyyteen. Kun kysely liputetaan, käyttäjä saa laimennetun vastauksen vanhemmalta tekoälyltä. Tästä mallin vaihtumisesta ei kuitenkaan kerrota käyttäjälle suoraan . Tilannetta pahensi se, miten tämä tieto paljastui. Kriitikoiden mukaan toimintalogiikka tuotiin ilmi ainoastaan syvällä 319-sivuisessa teknisessä järjestelmäkortissa, mikä johti syytöksiin siitä, että Anthropic olisi syyllistynyt mallin kyvykkyyksien ”salaiseen sabotaasiin” tiettyjä käyttäjiä kohtaan
.
Rajoitukset eivät rajoitu vain kyberturvallisuuteen. Suojukset kohdistuvat myös biologiaa, kemiaa ja, kriittisesti, tekoälymallien ”tislausta” koskeviin kyselyihin. Tämä viimeinen kohta on synnyttänyt oman vastalausemyrskynsä, ja jotkut kehittäjät syyttävät Anthropicia siitä, että se käyttää ”turvallisuutta” verukkeena kilpailua rajoittavalle toiminnalle estämällä muita tekoälyn kehittäjiä käyttämästä Fable 5:n tuotoksia koulutukseen .
Anthropicin turvajärjestelmä Fable 5:ssä ei ole yksinkertainen kieltomekanismi. Se on reititysjärjestelmä, joka on suunniteltu epäonnistumaan hiljaa . Arkkitehtuuri toimii kolmessa vaiheessa:
Anthropicin mukaan nämä luokittelijat laukeavat keskimäärin alle 5 prosentissa kaikista istunnoista . Yhtiö on julkisesti myöntänyt ylilyöntien ongelman. Anthropicin edustaja kertoi Business Insiderille, että turvatoimet ”saattavat liputtaa turvallista, neutraalia tai harmitonta sisältöä”, mutta perusteli tätä kompromissina, jotta näin kyvykäs malli voitaisiin ylipäätään julkaista julkisesti
.
Anthropicin kanta on, että konservatiiviset suojukset ovat tietoinen ja vastuullinen valinta, eivät virhe. Yhtiö väittää, että taustalla oleva Mythos-luokan malli on niin taitava esimerkiksi ohjelmistohaavoittuvuuksien löytämisessä ja hyödyntämisessä, että sen rajoittamaton julkinen julkaisu aiheuttaisi liian suuren katastrofaalisen väärinkäytön riskin .
Suojukset ovat heidän mukaansa suunnittelukompromissi – tapa tarjota yleisölle huipputason päättely-, koodaus- ja kirjoitusmalli, samalla kun sen vaarallisimmat potentiaaliset kyvyt eristetään hiekkalaatikkoon . He näkevät ylilyönnit väliaikaisena hintana siitä, että tehokas malli voidaan julkaista ”sekä turvallisesti että nopeasti”, ja lupaavat hienosäätää luokittelijoita ajan myötä
.
Claude Fable 5:n julkaisua ei voi täysin ymmärtää yksittäisenä tapauksena. Se on toinen puoli kaksitasoisesta julkaisustrategiasta, josta on tulossa uusi alan standardi huipputekoälymalleille .
Samana päivänä kun Fable 5 julkaistiin, Anthropic julkisti myös Claude Mythos 5:n. Molemmat mallit jakavat täsmälleen saman perusarkkitehtuurin ja painokertoimet – ne ovat sama ”aivot”. Ainoa ero on turvallisuusasetuksissa. Mythos 5:stä on poistettu luokittelijat arkaluonteisilla osa-alueilla, mikä antaa sille sen täydet, rajoittamattomat kyvyt .
Mythos 5 ei kuitenkaan ole tarkoitettu suurelle yleisölle. Se on rajoitettu pienelle joukolle tarkastettuja kumppaneita, mukaan lukien valtion virastoja ja kriittisen infrastruktuurin toimijoita, Project Glasswing -nimisen aloitteen kautta . Tämä Yhdysvaltain hallituksen tukema ohjelma käynnistettiin alun perin 12 perustajakumppanin voimin, ja siihen kuuluu teknologiajästejä, kuten AWS, Google ja Microsoft. Tarkoituksena on antaa ”kyberpuolustajien” käyttää tekoälyä haavoittuvuuksien laajamittaiseen löytämiseen ja paikkaamiseen
. Mythos 5:n myötä pääsyä laajennettiin noin 40 organisaatioon
.
Alla oleva taulukko havainnollistaa perustavanlaatuisen kahtiajaon:
Anthropicin Fable/Mythos-jako on selkein esimerkki siitä, mitä voidaan kutsua tekoälyn kyvykkyysperusteiseksi porrastetuksi käyttöönotoksi. Tässä uudessa mallissa yksittäinen huipputekoäly ei ole yksi tuote. Sen täysi voima on etuoikeus, ei itsestäänselvyys, ja turvasuojukset ovat mekanismi, joka luo tuote-eroavaisuuden .
Tämä käytäntö ei ole vain Anthropicin yksinoikeus. Myös muut johtavat tekoäly-yritykset, kuten OpenAI, ovat omaksuneet samankaltaisia lähestymistapoja tarjoamalla rajoitetun pääsyn versioihin edistyneimmistä malleistaan kansallisen turvallisuuden ja tutkimuskumppaneiden käyttöön . Fable/Mythos-julkistus kiteyttää tulevaisuuden, jossa tekoälyn tehokkaimmat kyvyt on aidattu pois ei teknologian, vaan tarkastusstatuksen perusteella. Tässä mallissa turvallisuusprotokollat toimivat samalla pääsynhallintamekanismeina – lähestymistapa, joka herättää jo nyt laajempaa keskustelua keskittämisestä, oikeudenmukaisuudesta ja ”julkisen” tekoälyturvallisuuden todellisesta merkityksestä.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Tietoturva asiantuntijat kritisoivat Anthropicin Claude Fable 5:tä, koska se liputtaa aggressiivisesti jopa viattomat kyberturvaan liittyvät kyselyt ja ohjaa ne salaa heikommalle tekoälymallille ilmoittamatta siitä kä...
Tietoturva asiantuntijat kritisoivat Anthropicin Claude Fable 5:tä, koska se liputtaa aggressiivisesti jopa viattomat kyberturvaan liittyvät kyselyt ja ohjaa ne salaa heikommalle tekoälymallille ilmoittamatta siitä kä... Kohu kärjistyi, kun paljastui, että malli reitittää arkaluontoiset kyselyt vanhemmalle Claude Opus 4.8:lle – mekanismi, jonka kriitikot sanovat piilotetun 319 sivuiseen tuoteselosteeseen.
Rajoitetun julkisen Fable 5:n julkaisu yhdessä rajoittamattoman, vain kumppaneille suunnatun Mythos 5:n kanssa viestii uudesta alan standardista, jossa tekoälyn täydet kyvyt ovat etuoikeus, eivät itsestäänselvyys.