SAFEの中核となるコンセプトは、組織がAIセキュリティインシデントや重大事故に至らなかった「ニアミス」を秘密裡に報告・分析し、匿名化された防御策をエコシステム全体で共有できるようにするフレームワークです。RFCのリポジトリは
github.com/OpenSecureAIAlliance/RFCs で公開されています。
3社とも2025年にホワイトハウス宛てにAIセキュリティ対策を求める公開書簡に署名していたにもかかわらず、OSAA発足時にはいずれも参加しませんでした。複数のメディアがこれを大きなギャップとして指摘しています。
OpenAIとAnthropicは設立メンバーリストに「明らかに欠けている」と名指しされました。背景事情として、OpenAIの不参加はクローズドモデル陣営とNvidiaのオープンソース志向連合との間の緊張を反映していると報じられています
。Googleも不参加でしたが、MicrosoftやAmazonなど他のクラウド大手は参加しています
。
一部報道によれば、ある企業が自社の侵害サーバーを調査しようとした際、名前の明かされていない企業のクローズドAIモデルが妨害になったという過去のインシデントが、OSAAのオープンアプローチの動機付けになったとされています。
複数の分析記事は、OSAAの異例の速さでの進展を地政学的な競争に直接結びつけています。
この連合は、特に中国の研究所からのAI脅威に対する懸念が高まる中で設立されました。中国のAIラボは、DeepSeekの派生モデルなど、強力なオープンウェイトモデルをリリースしており、米国当局はこれらが悪用されたり、強固なセキュリティガードレールを欠く可能性を懸念しています。
OSAAの迅速な成果—わずか1週間でのワーキンググループとRFCの公開—は、業界が脅威の状況よりも速く動き、中国政府の支援を受けるオープンモデルエコシステムと競争できるというシグナルとして明確に位置づけられています。OSAAは自らのセキュリティツールをオープンソース化することで、中国主導の標準が定着する前にAI安全の世界標準を確立し、オープンウェイトモデルを利用する企業に、中国製モデルが本質的に提供しないセキュリティ層を提供することを目指しています
。
この連合立ち上げの直接のきっかけは、数日前に自律型AIエージェントがHugging Faceのサーバーに侵入したという具体的なインシデントでした。これは、中国のオープンウェイトモデルが大規模に実現し得る攻撃の具体的なデモンストレーションとなりました。