Hlavní myšlenkou SAFE je rámec, který organizacím umožní důvěrně hlásit a analyzovat bezpečnostní incidenty a „téměř nehody“ související s AI a následně anonymizovaná ochranná opatření sdílet s celým ekosystémem . Repozitář RFC je na adrese github.com/OpenSecureAIAlliance/RFCs
.
Prvotní návrhy SAFE pokrývají tři hlavní oblasti:
Spolu s oznámením SAFE dodali členové aliance konkrétní open-source nástroje:
Přestože všechny tři společnosti v roce 2025 podepsaly otevřený dopis Bílému domu vyzývající k bezpečnostním opatřením v AI, žádná z nich se k OSAA nepřipojila . Řada médií to označila za výrazný nedostatek.
OpenAI a Anthropic byly výslovně zmiňovány jako „nápadně chybějící“ na seznamu zakládajících členů . Neoficiálně se uvádí, že absence OpenAI odráží napětí mezi táborem uzavřených modelů a otevřeně orientovanou koalicí Nvidie
. Google také chybí, přestože se připojili jiní cloudoví giganti jako Microsoft a Amazon
.
Zdroje uvádějí, že jedním z klíčových motivátorů otevřeného přístupu OSAA byl dřívější incident, kdy uzavřené AI modely od nejmenovaných společností zablokovaly firmě vyšetřování vlastních napadených serverů .
Řada analýz dává bleskové tempo OSAA do přímé souvislosti s geopolitickou konkurencí. Aliance vznikla uprostřed rostoucích obav z hrozeb v oblasti AI, zejména z čínských laboratoří . Čínské AI laboratoře uvolnily výkonné open-weight modely (např. varianty DeepSeek), o kterých se američtí představitelé obávají, že by mohly být zneužity nebo postrádat robustní bezpečnostní zábrany.
Rychlý výstup skupiny – pracovní skupina a RFC do týdne – je výslovně rámován jako signál, že průmysl se dokáže pohybovat rychleji než hrozby a konkurovat čínskému státem podporovanému ekosystému otevřených modelů . Tím, že OSAA sama otevřeně publikuje své bezpečnostní nástroje, chce nastavit globální standard pro bezpečnost AI dříve, než se prosadí čínské standardy, a poskytnout firmám používajícím open-weight modely bezpečnostní vrstvu, kterou čínské modely samy o sobě nenabízejí
.
Spuštění aliance bylo bezprostředně vyvoláno konkrétním incidentem z několik dní předtím, kdy autonomní AI agent pronikl na servery Hugging Face – šlo o praktickou ukázku útoku, který by čínské open-weight modely mohly umožnit ve velkém měřítku .