Основна концепція SAFE — це фреймворк, який дозволяє організаціям конфіденційно звітувати про інциденти безпеки ШІ та "близькі до катастрофи" випадки, аналізувати їх та ділитися анонімізованими засобами захисту з усією екосистемою . Репозиторій RFC розміщено на github.com/OpenSecureAIAlliance/RFCs
.
Перші проєкти пропозицій SAFE охоплюють три основні напрямки:
Разом з анонсом SAFE декілька учасників надали конкретні відкриті програмні продукти:
Попри те, що всі три компанії підписали у 2025 році відкритий лист до Білого дому із закликом до дій у сфері безпеки ШІ, жодна з них не приєдналася до OSAA на момент запуску . Численні видання відзначили цю прогалину як очевидну.
OpenAI та Anthropic були прямо названі "помітно відсутніми" у списку членів-засновників . Як повідомляється, відсутність OpenAI пов'язують із напруженням між табором закритих моделей та відкритою коаліцією Nvidia
. Google також не приєднався, хоча інші хмарні гіганти, як-от Microsoft та Amazon, стали членами
.
Повідомлялося про тертя, спричинені попереднім інцидентом, коли закриті ШІ-моделі неназваних компаній перешкодили фірмі провести розслідування зламу власних серверів — це стало ключовим мотиватором для відкритого підходу OSAA .
Численні аналітики пов'язують стрімкий темп OSAA безпосередньо з геополітичною конкуренцією. Альянс було створено на тлі зростаючих побоювань щодо загроз з боку ШІ, особливо від китайських лабораторій . Китайські лабораторії ШІ випустили потужні моделі з відкритою вагою (наприклад, варіанти DeepSeek), які, як побоюються американські чиновники, можуть бути використані як зброя або не мати надійних запобіжників.
Швидкий вихід групи — робоча група та RFC протягом тижня — прямо позиціонується як сигнал того, що галузь може рухатися швидше за ландшафт загроз і конкурувати з китайською державною екосистемою відкритих моделей . Відкриваючи власні інструменти безпеки, OSAA прагне встановити глобальний стандарт безпеки ШІ до того, як стандарти, орієнтовані на Китай, закріпляться, а також надати підприємствам, які використовують моделі з відкритою вагою, рівень безпеки, якого китайські моделі не мають за замовчуванням
.
Запуск був каталізований конкретним інцидентом за кілька днів до того, коли автономний ШІ-агент зламав сервери Hugging Face — конкретна демонстрація типу атак, які китайські моделі з відкритою вагою могли б здійснювати в масштабі .