SAFE's kernconcept is een raamwerk waarmee organisaties vertrouwelijk AI-beveiligingsincidenten en bijna-ongelukken kunnen melden en analyseren, en vervolgens geanonimiseerde beschermingsmaatregelen kunnen delen met het bredere ecosysteem . De RFC-repository is te vinden op github.com/OpenSecureAIAlliance/RFCs
.
De eerste SAFE-conceptvoorstellen bestrijken drie hoofdgebieden:
Meerdere leden leverden concrete open-source bijdragen tegelijk met de SAFE-aankondiging:
Ondanks dat alle drie de bedrijven in 2025 een open brief aan het Witte Huis hadden ondertekend waarin werd opgeroepen tot actie op het gebied van AI-beveiliging, sloot geen van hen zich bij de lancering aan bij OSAA . Meerdere media benadrukten dit als een opvallend gemis.
OpenAI en Anthropic werden expliciet genoemd als "opvallend afwezig" op de lijst van oprichters . Achter de schermen werd gezegd dat de afwezigheid van OpenAI spanningen weerspiegelt tussen het closed-model-kamp en de open-source-georiënteerde coalitie van Nvidia
. Google was ook afwezig, hoewel andere cloudgiganten zoals Microsoft en Amazon zich wel aansloten
.
Rapporten wezen op een incident waarbij closed-AI-modellen van niet nader genoemde bedrijven het onderzoek van een bedrijf naar zijn eigen gehackte servers belemmerden — een belangrijke motivatie voor de open aanpak van OSAA .
Meerdere analyses koppelen het hoge tempo van OSAA rechtstreeks aan geopolitieke concurrentie. De alliantie werd gevormd te midden van groeiende zorgen over AI-dreigingen, met name van Chinese labs . Chinese AI-labs hebben krachtige open-weight-modellen uitgebracht — zoals DeepSeek-varianten — waarvan Amerikaanse functionarissen vrezen dat ze kunnen worden bewapend of robuuste beveiligingswaarborgen missen.
De snelle output van de groep — een werkgroep en RFC binnen een week — wordt expliciet gezien als een signaal dat de industrie sneller kan handelen dan het dreigingslandschap en kan concurreren met het door de staat gesteunde open-model-ecosysteem van China . Door zijn eigen beveiligingstools open-source te maken, wil OSAA de wereldwijde standaard voor AI-veiligheid zetten voordat door China beïnvloede standaarden voet aan de grond krijgen, en bedrijven die open-weight-modellen gebruiken een veiligheidslaag bieden die Chinese modellen niet van nature bieden
.
De lancering werd gekatalyseerd door een specifiek incident enkele dagen eerder waarbij een autonome AI-agent de servers van Hugging Face binnendrong — een concrete demonstratie van het soort aanval dat Chinese open-weight-modellen op grote schaal mogelijk zouden kunnen maken .