הגנה לעומק לפי שכבות – בלוג האבטחה של מיקרוסופט (מאי 2026) מגדיר ארבע שכבות הפחתה: שכבת המודל (נתוני אימון, כיוונון עדין, התנהגויות סירוב), שכבת מערכת הבטיחות (סינון תוכן בזמן ריצה, מעקות בטיחות, תיעוד, נראות), שכבת היישום (הרשאות, זרימות עבודה, מסלולי הסלמה) ושכבת המיצוב (תיעוד שקיפות וחשיפות UX) . פוסט מאוחר יותר ביוני מוסיף תצוגה מפורטת יותר של ארבע שכבות: שכבת המודל, שכבת מערכת הבטיחות, שכבת המטה-פרומפט והעיגון והשכבה הסוכנית (הרשאות שימוש בכלים ובדיקות אנושיות בלולאה) .
רשימות אישור ברמת הדייר לשרתי MCP – ארגונים חייבים לנהל רשימה מאושרת של מפרסמים ושרתי MCP. קטלוג ה-MCP של מיקרוסופט מספק שרתים מאומתים של צד ראשון, וכל הרכיבים החיצוניים מטופלים כחלק משרשרת האספקה של התוכנה. ההמלצה היא להשבית "אפשר הכל" בחיבורי MCP ולהפעיל רק את הכלים הספציפיים שהסוכן צריך .
יצירת SBOM לפריסות סוכנים – רשימת חומרי תוכנה הכוללת תלויות כלים, עם אימות חתימה ומקור לשרתי MCP לפני התקנה. מיקרוסופט גם ממליצה על סריקת registry להוראות נסתרות בתיאורי כלים, קיבוע גרסאות עם ניטור שינויים לכל הגדרות הכלים החיצוניים .
מעקות בטיחות מבוססי מדיניות – מעבר לניטור, ארגונים יכולים להחיל בקרות מבוססות מדיניות כדי לקבוע מה מותר לסוכנים לעשות, הנאכפות באמצעות Agent 365 SDK ותשתית המדיניות של Windows . בלוג המפתחים של Windows מציין: "בלימה מגבילה למה סוכנים יכולים לגשת ולעשות, כך שהתנהגות לא-דטרמיניסטית לא מתורגמת לסיכון בלתי נשלט" .
ממשל במישור הבקרה – בעלות ריכוזית, ניהול מחזור חיים של זהויות ואכיפת תאימות על פני כל הסוכנים בארגון. מסגרת אימוץ הענן של Azure ממליצה על הקמת קו בסיס ממשל ואבטחה מרכזי ואכיף המותאם לפרקטיקות הקיימות של זהויות, ממשל נתונים ואבטחה .
המסגרת מכוונת לשרשרת התקיפה המלאה – הרעלת שרשרת אספקה (באמצעות רשימות אישור ו-SBOM), הסלמת הרשאות (באמצעות בידוד MXC), הוצאת נתונים (באמצעות מעקות בטיחות בזמן ריצה וסינון תוכן) ושימוש לא מורשה בכלים (באמצעות בקרות הרשאות ולולאות אנושיות בלולאה) . הטקסונומיה של מיקרוסופט למצבי כשל לאחר שנה של Red Teaming במערכות סוכניות מוסיפה ארכיטקטורת אפס-אמון בין סוכנים: בתרחישים בסיכון גבוה, זהות הסוכן צריכה להתבסס קריפטוגרפית, לא להניח ממיקום בזרימת עבודה .
שתי יוזמות מרכזיות באמצע 2026 ממחישות את המפנה של התעשייה לעבר שימוש בסוכני AI באופן התקפי והגנתי בסייבר, תוך הטלת מגבלות מחמירות יותר.
הוכרז ב-27 ביולי 2026, Project Perception הוא מערכת אבטחה סוכנית שעוברת מעבר ליצירת התראות לפעולה אוטומטית רציפה . מיקרוסופט תיארה אותו כ"מערכת הגנה הלומדת ברציפות" שיכולה "להסיק, לתעדף ולפעול במהירות מחשב תוך שמירה על שליטה אנושית איתנה" .
למה זה חשוב: זוהי דוגמה קונקרטית לסוכני AI הניתנים לתפקידי הגנה אוטונומיים פעילים – סורקים מערכות, מתקנים פרצות ומגיבים לאיומים ללא המתנה להכוונה אנושית. הבקרה ההדוקה יותר מגיעה מכללי הבלימה לעיל: סוכני Project Perception עדיין פועלים בתוך מכולות MXC, תחת מעקות בטיחות מבוססי מדיניות, עם נראות ופיקוח אנושי .
הוקמה ב-27 ביולי 2026 – ימים ספורים לאחר תקרית אבטחה חמורה ב-Hugging Face שהדגישה את הסיכונים באובדן שליטה על סוכני AI אוטונומיים – OSAA היא קואליציה תעשייתית הבונה כלי אבטחת קוד פתוח לסוכני AI .
למה זה חשוב: OSAA מייצגת הכרה תעשייתית קולקטיבית שאף ספק יחיד לא יכול לאבטח סוכנים אוטונומיים לבדו. ההתמקדות של הברית במודלים פתוחים ובכלים משותפים היא ניגוד מכוון לגישות קנייניות סגורות – ההימור הוא שגישה קהילתית רחבה יותר לכלי אבטחה תקדים תוקפים . Nvidia הצהירה: "מודלים פתוחים מדמוקרטיזציה של יכולות הגנתיות, מגבירים שקיפות עבור מגינים, מאפשרים הגנת סייבר תוך הגנה על נתונים, ומשלימים מודלים סגורים מתקדמים עם בקרות ניתנות להתאמה אישית ומקומיות" .
| מימד | מיקרוסופט | התעשייה (OSAA / Nvidia) |
|---|---|---|
| פילוסופיית בקרה | בלימה ברמת מערכת ההפעלה (MXC), מעקות בטיחות מבוססי מדיניות, בקרות שרשרת אספקה | כלים משותפים בקוד פתוח, הנחיות שקופות (SAFE), הגנה מונחית קהילה |
| הגנה פעילה | Project Perception – סוכנים אוטונומיים אדומים/כחולים/ירוקים שאיתור, מתקנים ומטפלים | רתמות סוכנים פתוחות ומעקות בטיחות בזמן ריצה המאפשרים פעולות סוכניות בטוחות |
| סיכון מטופל | פעולות סוכן לא מורשות, הוצאת נתונים, הרעלת שרשרת אספקה | אובדן שליטה על סוכן, חשיפת פרצות אטומה, כלי אבטחה מקוטעים |
| אילוץ מרכזי | סוכנים פועלים במכולות נעולות תחת מדיניות שהוגדרה על ידי אדם | קווי בסיס אבטחה משותפים ומסגרות פתוחות מונעים נעילת ספק תוך העלאת הרף |
התבנית ברורה: אותן חברות שדוחפות סוכני AI לתפקידי הגנה אוטונומיים פעילים, הן גם אלה שממהרות לבנות את מבני הבלימה והממשל שמונעים מאותם סוכנים להפוך לדור הבא של איומי האבטחה.