SAFEs kärnkoncept är ett ramverk som gör det möjligt för organisationer att konfidentiellt rapportera och analysera AI-säkerhetsincidenter och tillbud och därefter dela anonymiserade skyddsåtgärder med hela ekosystemet . RFC-förvaret finns på github.com/OpenSecureAIAlliance/RFCs
.
De första SAFE-utkasten omfattar tre huvudområden:
Flera medlemmar levererade konkreta bidrag med öppen källkod i samband med SAFE-nyheten:
Trots att alla tre företagen undertecknade ett öppet brev till Vita huset 2025 med krav på AI-säkerhetsåtgärder, gick inget av dem med i OSAA vid lanseringen . Flera medier pekade på detta som en påtaglig brist.
OpenAI och Anthropic omnämndes uttryckligen som ”anmärkningsvärt frånvarande” från grundarmedlemslistan . Bakom kulisserna uppgavs OpenAIs frånvaro återspegla spänningar mellan lägret för slutna modeller och Nvidias koalition med öppen källkod
. Google var också frånvarande, medan andra molnjättar som Microsoft och Amazon anslöt sig
.
Rapporter nämnde friktion från en tidigare incident där slutna AI-modeller från icke namngivna företag hindrade ett företags utredning av sina egna intrångsservrar – en viktig motivationsfaktor för OSSAAs öppna ansats .
Flera analyser kopplar OSSAAs blixtsnabba framfart direkt till geopolitiska spänningar. Alliansen bildades mot bakgrund av växande oro för AI-hot, särskilt från kinesiska labb . Kinesiska AI-labb har släppt kraftfulla modeller med öppen vikt – som DeepSeek-varianter – som amerikanska tjänstemän befarar kan beväpnas eller sakna robusta säkerhetsbarriärer.
Gruppens snabba utfall – en arbetsgrupp och RFC inom en vecka – ses uttryckligen som en signal om att branschen kan röra sig snabbare än hotbilden och konkurrera med Kinas statsstödda ekosystem för öppna modeller . Genom att själva publicera sina säkerhetsverktyg som öppen källkod vill OSAA sätta den globala standarden för AI-säkerhet innan kinesiska standarder hinner etableras, och ge företag som använder modeller med öppen vikt ett säkerhetslager som kinesiska modeller inte har inbyggt
.
Lanseringen utlöstes av en specifik incident dagar tidigare, där en autonom AI-agent bröt sig in på Hugging Faces servrar – en konkret demonstration av den typ av attack som kinesiska modeller med öppen vikt skulle kunna genomföra i stor skala .