המטרה היא להפוך כשל נקודתי למודיעין הגנתי משותף. במקום שכל ארגון יתמודד לבדו עם הזרקת פקודות, דליפות מידע או סוכן שסוטה מהמשימה שלו, SAFE מבקשת ליצור דרך מסודרת להפיק מתקריות בודדות אמצעי הגנה רחבים יותר.
SAFE היא רק רכיב אחד בתוכנית של OSAA. הברית מרכזת גם טכנולוגיות קוד פתוח וניתנות לבדיקה, שכל אחת מהן מתייחסת לשכבה אחרת באבטחת סוכני AI.
בין התרומות שעליהן דווח:
ביחד, הרכיבים האלה מכסים זהות, הרשאות, מסגרות הפעלה לסוכנים, התנהגות בזמן ריצה, הערכה, נתונים, ממשל ועמידות. אם יבשילו, הם עשויים לספק לארגונים סט משותף של כלים להגבלת סוכני AI, לניטורם ולהתמודדות עם סוכנים זדוניים או כאלה שפועלים מחוץ לתחום שהוגדר להם. בשלב זה מדובר באפשרות — לא בתוצאה שהוכחה.
לפי הדיווחים, בתוך השבוע הראשון הצטרפו ל-OSAA יותר מ-120 ארגונים. בין המשתתפים המרכזיים שצוינו: Nvidia, Adobe, BlackRock, Cisco, CrowdStrike, Hugging Face, Intel, Microsoft, Red Hat ו-Visa. אמזון תוארה כחברה שהצטרפה בשלב מאוחר יותר.
הברית נולדה זמן קצר לאחר מכתב פתוח מ-24 ביולי, שקרא לקובעי המדיניות בארצות הברית להימנע מהגבלות רחבות או מוקדמות על מודלים פתוחים-במשקל — מודלים שניתן להוריד, לבדוק, לשנות ולהריץ באופן עצמאי. המכתב, שנחתם בתחילה בידי 25 חברות, בהן Nvidia, Microsoft, Meta, IBM, Dell, Palantir ו-Hugging Face, טען שהגבלת מודלים להורדה עלולה לפגוע בתחרות ולדחוף משתמשים לעבר מערכות AI סיניות, בזמן שוושינגטון שוקלת את תגובתה הביטחונית הלאומית.
בעת הדיווחים מ-Black Hat, Anthropic, OpenAI ו-Google בלטו כחברות שלא הצטרפו ל-OSAA. עם זאת, התמונה סביב מכתב המדיניות מורכבת יותר: הדיווחים חלוקים בשאלה מי נכלל ברשימת החותמות המאוחרת. חלקם טענו ש-OpenAI ו-Google נוספו בהמשך, ואחרים תיארו אותן כמי שלא היו חלק מהקבוצה המקורית.
המקורות הזמינים אינם מסבירים מדוע החברות הללו לא הצטרפו ל-OSAA, ולכן אין לייחס להיעדרן מניע מסוים.
הטענה המרכזית של OSAA היא שפתיחות ואבטחה אינן חייבות לסתור זו את זו. מודלים, כלי בדיקה, הערכות ולקחים מתקריות שפתוחים לבדיקה יכולים לאפשר ליותר מגינים לזהות כשלים, לשחזר חולשות ולהתאים פתרונות. SAFE מנסה לשלב בין שקיפות לבין סודיות: המידע על התקרית ייאסף וינותח באופן חסוי, בעוד שהלקחים הכלליים יוכלו להיות משותפים באופן רחב יותר.
ההרכב הבין-תעשייתי של הברית עשוי לסייע גם ביצירת ממשקים ושיטות עבודה משותפים בין מפתחי מודלים, ספקיות ענן ותשתית, חברות זהות ואבטחה ולקוחות ארגוניים. אם המאמצים יבשילו, מערכות AI פתוחות עשויות להפוך לקלות יותר לבדיקה, לשליטה ולפריסה אחראית.
התפתחות כזו עשויה לתמוך בטענה שמודלים פתוחים-במשקל הם גם סוגיה של תחרותיות אמריקאית, במיוחד על רקע הדיון בוושינגטון על ההתמודדות עם מעבדות AI סיניות. אבל OSAA עדיין לא הוכיחה שהיא שיפרה את התחרותיות של ארצות הברית או הפחיתה את הסיכון המערכתי של AI. נכון לעכשיו, ההישג המדיד שלה מצומצם וברור יותר: קואליציה של יותר מ-120 ארגונים עברה בתוך זמן קצר מה advocacy למודלים פתוחים אל טיוטה ציבורית לתיאום דיווח על תקריות אבטחת AI — ובמקביל החברים בה תורמים כלים שעשויים בעתיד להרכיב שכבת הגנה משולבת יותר.