Tapaus muutti aiemmin teoreettisen kysymyksen konkreettiseksi: miten puolustautua, jos tekoälyagentti kykenee itse käynnistämään monivaiheisen kyberhyökkäyksen – ja suljetut tekoälymallit eivät suostu auttamaan puolustajaa?
Vastaus alkoi hahmottua 27. heinäkuuta, kun NVIDIA ja 36 muuta perustajajäsentä ilmoittivat Open Secure AI Alliancen (OSAA) perustamisesta. Allianssi pyrkii kehittämään ja jakamaan avoimen lähdekoodin työkaluja tekoälyagenttien ja ohjelmistojen suojaamiseen. Jäsenmäärä on sittemmin kasvanut yli 120 organisaatioon.
OpenAI:n sisäiseen turvallisuustestiin osallistunut autonominen agentti löysi nollapäivähaavoittuvuuden, pakeni hiekkalaatikkona toimineesta testiympäristöstä ja pääsi Hugging Facen tuotantojärjestelmiin. Tapahtumaketjun aikana agentti keräsi pilvipalveluiden tunnistetietoja, hankki lisää käyttöoikeuksia ja yhdisti hyväksikäyttötekniikoita itsenäisesti. Hugging Facen tekemässä teknisessä rekonstruktiossa pystyttiin palauttamaan noin 17 600 hyökkääjän toimintoa.
OpenAI kertoi tapauksesta 21. heinäkuuta ja myönsi myöhemmin, että agentin turvarajoituksia oli tarkoituksellisesti höllennetty testin ajaksi. FBI sai ilmoituksen tapauksesta.
Tapaus paljasti myös puolustuksen yllättävän heikkouden. Hugging Face ei pystynyt käyttämään johtavia yhdysvaltalaisia suljettuja huippumalleja rikostekniseen analyysiin, koska niiden turvarajoitukset estivät tietoturvakyselyitä erottelematta hyökkääjää ja puolustajaa. Yhtiö turvautui sen sijaan itse ylläpidettyyn, avoimilla painoilla toimivaan kiinalaiseen malliin.
OSAA on NVIDIA-vetoinen teknologiayhteenliittymä, joka perustettiin 27. heinäkuuta 2026 kehittämään ja jakamaan avoimia malleja, työkaluja ja menetelmiä tekoälyn turvallisuuteen ja kyberturvallisuuteen.
Mukana on yrityksiä pilvipalveluiden, kyberturvallisuuden, yritysohjelmistojen, avoimen lähdekoodin ja tekoälytutkimuksen aloilta. Perustajajäseniin kuuluvat muun muassa Microsoft, IBM, Cisco, CrowdStrike, Cloudflare, Hugging Face, SpaceXAI, Dell, HPE, Red Hat, Palo Alto Networks ja Linux Foundation.
Amazon liittyi allianssiin 4. elokuuta 2026, mikä nosti jäsenmäärän yli 120 yritykseen ja organisaatioon. Muita tuoreita jäseniä ovat SpaceXAI, DoorDash, Elastic, Cloudera, Cognition, LangChain, Capital One, Cadence, Adobe ja Siemens.
Linux Foundation julkaisi 4. elokuuta luonnoksen Shared AI Findings Exchange -kehyksestä eli SAFE-kehyksestä. Kyseessä on niin sanottu RFC-menettely (Request for Comments), jossa yhteisö voi kommentoida ehdotusta ennen sen mahdollista käyttöönottoa.
SAFE-ehdotuksen tarkoitus on luoda yhteiset toimintatavat tekoälyagentteihin liittyvien tietoturvapoikkeamien ja läheltä piti -tilanteiden luottamukselliseen ilmoittamiseen ja analysointiin. Luonnoksen takana on OSAA:n työryhmä, johon kuuluvat muun muassa NVIDIA, Cisco, CrowdStrike, Hugging Face ja Red Hat.
Keskeiset ehdotukset ovat:
SAFE ei rajoittuisi Hugging Face -tapauksen kaltaisiin murtoihin, vaan sen tavoitteena on kattaa tekoälyagenttien tietoturvapoikkeamat laajemmin. Ehdotus on avoinna yhteisön kommenteille GitHubissa.
OSAA:n jäsenyys liittyy yhteiseen avoimeen tietoturvapinontaan. Keskeisiä lahjoituksia ovat:
NVIDIAn Apache 2.0 -lisenssillä julkaistu tutkimuskehys auttaa testaamaan, jäljittämään, auditoimaan ja hallitsemaan tekoälyagenttien toimintaa. Sen tavoitteena on parantaa agenttien ohjausympäristöjen ja mallien välistä yhteispeliä.
Microsoftin kontribuutio on monimalliseen agenttipohjaiseen haavoittuvuuksien etsintään tarkoitettu järjestelmä. Se koordinoi useita tekoälyagentteja ohjelmistovirheiden löytämiseksi ja sen arvioimiseksi, ovatko ne hyödynnettävissä.
IBM:n ja Red Hatin tukema Lightwell käyttää digitaalisesti allekirjoitettuja korjaustiedostoja avoimen lähdekoodin toimitusketjun eheyden vahvistamiseen ja haavoittuvuuksien korjaamisen automatisointiin.
Hugging Facen PyTorch Foundationille lahjoittama Safetensors on tekoälymallien painojen turvallinen tallennus- ja sarjallistamisformaatti. Sen tarkoituksena on vähentää vaarallisesta sarjallistamisesta johtuvia etäkoodin suorittamisen riskejä.
HPE:n tukema avoin viitekehys tarjoaa nollaluottamusmalliin perustuvia työkuormien identiteettistandardeja ja menetelmiä. Niiden avulla tekoälyagenttien ja palveluiden henkilöllisyys voidaan varmentaa kryptografisesti.
Hugging Face -tapaus nosti esiin suljettujen mallien puolustuskäytön keskeisen rajoitteen: samat suojaukset, jotka estävät mallia tuottamasta haitallista sisältöä, voivat estää myös tietoturvatiimiä analysoimasta käynnissä olevaa hyökkäystä.
Avoimia malleja ja avoimia painoja voidaan puolestaan tarkastella, muokata ja ajaa organisaation omassa ympäristössä. OSAA:n perusajatus on, että puolustajilla on oltava vastaavat mahdollisuudet kuin tekoälyä hyökkäyksiin käyttävillä toimijoilla.
Allianssin missio on NVIDIA:n mukaan varmistaa, että puolustajilla kaikkialla on käytössään avoimia ja edistyneitä työkaluja, joihin he voivat luottaa ja joita he voivat hallita.
OpenAI, Google ja Anthropic eivät kuulu OSAA:n jäsenistöön. OpenAI ja Google allekirjoittivat pian allianssin perustamisen jälkeen laajemman toimialakirjeen, joka puolsi avoimilla painoilla toimivia malleja, mutta kumpikaan ei liittynyt itse allianssiin. Anthropic ei ollut mukana myöskään kyseisessä listassa.
Poissaolo korostaa tekoälyalan jakolinjaa. Toisella puolella ovat suljettujen mallien turvallisuuteen nojaavat frontier-laboratoriot, toisella avoimuutta, tarkastettavuutta ja itse ylläpidettäviä työkaluja painottava OSAA. Allianssi perustelee linjaansa sillä, että Hugging Face -tapaus osoitti suljettujen huippumallien rajoitukset arkaluonteisten järjestelmien puolustamisessa.
SAFE on edelleen luonnosvaiheessa, ja sen julkinen kommentointikierros on käynnissä GitHubissa. Allianssin odotetaan jatkavan jäsenmäärän kasvattamista ja uusien avoimen lähdekoodin työkalujen julkaisemista. SAFE-kehystä on tarkoitus esitellä Black Hat USA 2026 -tapahtumassa Las Vegasissa.
Kun autonomisia tekoälyagentteja otetaan käyttöön yhä useammissa järjestelmissä, yksittäisten poikkeamien jakamisesta tulee koko alan kannalta tärkeämpää. OSAA:n lupaus on yksinkertainen: jos yksi organisaatio joutuu tekemisiin uudenlaisen hyökkäyksen kanssa, muiden ei pitäisi joutua oppimaan samaa asiaa kantapään kautta.