Bij AI-beveiliging doet zich steeds hetzelfde probleem voor: organisaties ontdekken aanvallen, storingen of bijna-incidenten vaak afzonderlijk. Andere bedrijven lopen vervolgens tegen vergelijkbare risico’s aan zonder toegang tot de lessen die al zijn geleerd.
Het SAFE-voorstel richt zich op vier samenhangende praktijken:
Het doel is gedeelde defensieve informatie. Een incident met promptinjectie, datalekken of een agent die buiten zijn opdracht handelt, hoeft dan niet langer voor iedere organisatie een op zichzelf staand probleem te zijn. Deelnemers zouden individuele fouten kunnen vertalen naar bredere beveiligingsmaatregelen.
SAFE is slechts één onderdeel van OSAA. De alliantie brengt ook open en controleerbare technologieën samen voor verschillende lagen van de beveiliging van AI-agents.
Genoemde bijdragen zijn onder meer:
Samen bestrijken de projecten identiteit, toegangsrechten, agentframeworks, gedrag tijdens runtime, evaluatie, data, governance en veerkracht. In de toekomst zouden ze ondernemingen een gemeenschappelijke set hulpmiddelen kunnen geven om AI-agents te begrenzen en te monitoren, ook wanneer die zich kwaadaardig gedragen of buiten hun bedoelde opdracht opereren. Dat blijft voorlopig een mogelijkheid, geen vastgesteld resultaat.
Volgens de berichtgeving telde OSAA in de eerste week meer dan 120 organisaties. Tot de genoemde deelnemers behoren Nvidia, Adobe, BlackRock, Cisco, CrowdStrike, Hugging Face, Intel, Microsoft, Red Hat en Visa. Amazon werd als nieuwer lid genoemd.
De alliantie ontstond kort nadat op 24 juli een open brief was gepubliceerd waarin Amerikaanse beleidsmakers werden opgeroepen brede of voorbarige beperkingen op open-weight-AI-modellen te vermijden. De brief werd aanvankelijk gesteund door 25 bedrijven, waaronder Nvidia, Microsoft, Meta, IBM, Dell, Palantir en Hugging Face. Volgens de brief zouden beperkingen op downloadbare modellen de concurrentie kunnen verzwakken en gebruikers richting Chinese AI-systemen kunnen duwen, terwijl Washington nadacht over een reactie vanuit nationale veiligheid.
Ten tijde van de berichtgeving rond Black Hat waren Anthropic, OpenAI en Google opvallende afwezigen bij OSAA. De relatie met de open brief is minder eenduidig: bronnen verschillen over de latere lijst van ondertekenaars. Sommige berichten stellen dat OpenAI en Google later werden toegevoegd, terwijl andere ze alleen als afwezig bij de oorspronkelijke groep beschrijven.
De beschikbare bronnen verklaren niet waarom deze bedrijven geen lid waren van OSAA. Aan hun afwezigheid kan daarom geen motief worden gekoppeld.
De centrale stelling van OSAA is dat openheid en beveiliging geen tegenpolen hoeven te zijn. Wanneer modellen, hulpmiddelen, evaluaties en incidentlessen toegankelijker en controleerbaar zijn, kunnen meer verdedigers fouten onderzoeken, kwetsbaarheden reproduceren en oplossingen aanpassen. SAFE probeert die openheid te combineren met vertrouwelijkheid bij het verzamelen en analyseren van incidenten, terwijl algemene lessen breder worden gedeeld.
De samenstelling van de alliantie kan bovendien helpen om gemeenschappelijke standaarden te ontwikkelen voor modelbouwers, cloud- en infrastructuurleveranciers, identiteitspecialisten, beveiligingsbedrijven en zakelijke gebruikers. Als die inspanningen volwassen worden, kunnen open AI-systemen eenvoudiger te evalueren, te beheersen en verantwoord in te zetten zijn.
Dat zou het bredere beleidsargument kunnen ondersteunen dat open-weight-AI van belang is voor het Amerikaanse concurrentievermogen, zeker nu Amerikaanse beleidsmakers discussiëren over Chinese AI-labs. OSAA heeft echter nog niet aangetoond dat de alliantie de Amerikaanse concurrentiepositie heeft verbeterd of het systemische AI-risico heeft verlaagd.
De meetbare prestatie is voorlopig bescheidener en concreter: een coalitie van meer dan 120 organisaties is in korte tijd verschoven van lobbyen voor open AI naar een publiek concept voor gecoördineerde rapportage van AI-beveiligingsincidenten. Tegelijkertijd leveren leden hulpmiddelen aan die op termijn een beter samenwerkende verdedigingslaag kunnen vormen.