Tavoitteena on muuttaa yksittäiset tapaukset yhteiseksi puolustustiedoksi. Prompt injection -hyökkäyksiä, tietovuotoja tai hallitsemattomasti toimivia agentteja ei tarvitsisi käsitellä aina erillisinä tapauksina, jos niiden opetukset voidaan välittää muille ilman, että jokainen organisaatio joutuu aloittamaan selvitystyön alusta.
SAFE on vain yksi osa OSAA:n suunnitelmaa. Allianssi kokoaa yhteen avoimen lähdekoodin ja tarkastettavia teknologioita, jotka on tarkoitettu tekoälyagenttien eri turvallisuuskerroksiin.
Raportoidut panokset sisältävät muun muassa seuraavat:
Kokonaisuus kattaa identiteetin, käyttöoikeudet, agenttien ajoympäristöt, ajonaikaisen toiminnan, arvioinnin, datan, hallinnan ja palautumiskyvyn. Jos hankkeet kehittyvät yhteensopiviksi, yrityksille voisi muodostua yhteinen työkalukokonaisuus tekoälyagenttien rajoittamiseen ja valvontaan — myös silloin, kun agentti toimii haitallisesti tai sille annetun tehtävän ulkopuolella. Toistaiseksi kyse on kuitenkin mahdollisesta kehityssuunnasta, ei todistetusta tuloksesta.
OSAA:n kerrotaan kasvaneen ensimmäisen viikon aikana yli 120 organisaation verkostoksi. Mainittuja merkittäviä jäseniä ovat Nvidia, Adobe, BlackRock, Cisco, CrowdStrike, Hugging Face, Intel, Microsoft, Red Hat ja Visa. Amazonia on kuvattu uudemmaksi jäseneksi.
Allianssin taustalla oli 24. heinäkuuta julkaistu avoin kirje, jossa yhdysvaltalaisia päättäjiä kehotettiin välttämään laajoja tai ennenaikaisia rajoituksia avoimilla painoilla julkaistaviin AI-malleihin. Alkuperäisen, 25 yrityksen tukeman kirjeen allekirjoittajiin kuuluivat muun muassa Nvidia, Microsoft, Meta, IBM, Dell, Palantir ja Hugging Face. Kirjeen mukaan ladattavien mallien rajoittaminen voisi heikentää kilpailua ja ohjata käyttäjiä kiinalaisten AI-järjestelmien pariin, kun Washington pohti kansalliseen turvallisuuteen liittyvää vastaustaan.
Black Hatin yhteydessä julkaistujen tietojen mukaan Anthropic, OpenAI ja Google eivät kuuluneet OSAA:han. Kirjeen allekirjoittajalistasta on kuitenkin ristiriitaisia raportteja: joidenkin tietojen mukaan OpenAI ja Google lisättiin myöhemmin, kun taas toiset lähteet kuvaavat ne alkuperäisen ryhmän ulkopuolelle jääneiksi.
Saatavilla olevat lähteet eivät kerro, miksi kyseiset yritykset eivät olleet liittyneet OSAA:han, joten poissaololle ei ole perusteltua antaa tiettyä motiivia.
OSAA:n keskeinen väite on, etteivät avoimuus ja turvallisuus välttämättä ole toistensa vastakohtia. Avoimet mallit, työkalut, arvioinnit ja jaetut poikkeamahavainnot voivat antaa useammille puolustajille mahdollisuuden tarkastaa virheitä, toistaa haavoittuvuuksia ja ottaa korjauksia käyttöön. SAFE yrittää yhdistää tämän läpinäkyvyyden siihen, että poikkeamien kerääminen ja analysointi voidaan tehdä luottamuksellisesti ja yleistetyt opit jakaa laajemmalle.
Allianssin toimialarajat ylittävä kokoonpano voi myös auttaa luomaan yhteisiä rajapintoja ja käytäntöjä mallikehittäjien, pilvi- ja infrastruktuuritoimittajien, identiteettipalvelujen, tietoturvayritysten ja yritysasiakkaiden välille.
Jos työ kypsyy, avoimista AI-järjestelmistä voi tulla yrityksille helpompia arvioida, hallita ja ottaa vastuullisesti käyttöön. Tämä tukisi laajempaa yhdysvaltalaista politiikka-argumenttia, jonka mukaan avoimilla painoilla julkaistava tekoäly on myös kilpailukykykysymys suhteessa kiinalaisiin AI-laboratorioihin.
OSAA ei kuitenkaan ole vielä osoittanut parantaneensa Yhdysvaltojen kilpailuasemaa tai pienentäneensä tekoälyn järjestelmäriskiä. Tähänastinen konkreettinen saavutus on rajatumpi mutta selkeä: yli 120 organisaation koalitio on siirtynyt avoimen AI:n puolustamisesta julkisesti kommentoitavaan luonnokseen koordinoidusta tietoturvaraportoinnista, samalla kun sen jäsenet rakentavat mahdollisia yhteentoimivia puolustuskerroksia tulevaisuutta varten.