El concepto central de SAFE es un marco que permite a las organizaciones reportar y analizar de forma confidencial incidentes y casi incidentes de seguridad en IA, y luego compartir protecciones anonimizadas con todo el ecosistema . El repositorio de la RFC está alojado en github.com/OpenSecureAIAlliance/RFCs
.
Los borradores iniciales de SAFE cubren tres áreas principales:
Varios miembros lanzaron contribuciones concretas de código abierto junto con el anuncio de SAFE:
A pesar de que las tres empresas firmaron una carta abierta a la Casa Blanca en 2025 pidiendo acción en seguridad de IA, ninguna se unió a OSAA en su lanzamiento . Varios medios destacaron esto como una brecha evidente.
OpenAI y Anthropic fueron mencionados explícitamente como "notablemente ausentes" de la lista de miembros fundadores . Fuentes no oficiales indicaron que la ausencia de OpenAI reflejaba tensiones entre el modelo cerrado y la coalición orientada al código abierto de Nvidia
. Google también estuvo ausente, aunque otros gigantes de la nube como Microsoft y Amazon se unieron
.
Informes señalaron fricciones por un incidente previo en el que modelos cerrados de IA de empresas no identificadas obstruyeron la investigación de una firma sobre sus propios servidores violados —un motivador clave para el enfoque abierto de OSAA .
Múltiples análisis vinculan la velocidad vertiginosa de OSAA directamente con la competencia geopolítica. La alianza se formó en medio de crecientes preocupaciones sobre amenazas de IA, particularmente de laboratorios chinos . Laboratorios chinos han lanzado modelos de peso abierto potentes —como variantes de DeepSeek— que funcionarios estadounidenses temen que puedan ser armados o carecer de salvaguardas de seguridad robustas.
La rápida producción del grupo —un grupo de trabajo y una RFC en una semana— se enmarca explícitamente como una señal de que la industria puede moverse más rápido que el panorama de amenazas y competir con el ecosistema de modelos abiertos respaldado por China . Al abrir sus propias herramientas de seguridad, OSAA busca establecer el estándar global para la seguridad de la IA antes de que los estándares chinos se consoliden, y proporcionar a las empresas que usan modelos de peso abierto una capa de seguridad que los modelos chinos no ofrecen inherentemente
.
El lanzamiento fue catalizado por un incidente específico días antes en el que un agente de IA autónomo violó los servidores de Hugging Face —una demostración concreta del tipo de ataque que los modelos de peso abierto chinos podrían habilitar a gran escala .