الصدارة في المعايير. سجل Atlas 90.9% على معيار CyberGym، وهو معيار عام يقيس قدرة وكلاء الذكاء الاصطناعي على إعادة إنتاج واكتشاف الثغرات الواقعية في 1507 مهام مستمدة من 188 مشروع برمجي مفتوح المصدر . للمقارنة، تتخلف أفضل أنظمة النماذج الأحادية — GPT-5.5 Cyber (85.6%) وMythos من Anthropic (83%) — بنسبة تتراوح بين 5 و8 نقاط مئوية . حتى نظام MDASH من Microsoft، الذي استخدم أكثر من 100 وكيل متخصص ليحقق 88.45% في مايو 2026، تم تجاوزه .
أكثر من 200 اكتشاف للثغرات الصفرية. في اختباراته الخاصة، كشف Atlas عن أكثر من 200 ثغرة أمنية غير معروفة سابقاً في مشاريع مفتوحة المصدر واسعة الاستخدام والتي خضعت لتدقيق ومحاكاة اختراق مكثفة لسنوات، بما في ذلك Linux kernel وKubernetes وgVisor وcontainerd وdnsmasq . والأهم من ذلك، تم التحقق من صحة كل اكتشاف بشكل مستقل من طرف النظام الذكي، متجاوزاً مجرد الاشتباه الذي يولده النموذج إلى دليل قابل للتكرار على مشكلة أمنية حقيقية .
CVE-2026-3854 — ثغرة حرجة لتنفيذ الأكواد عن بعد في GitHub. حددت نسخة مبكرة من Atlas ثغرة حرجة لتنفيذ الأكواد عن بُعد (RCE) في البنية التحتية الداخلية لـ GitHub (CVE-2026-3854، درجة CVSS 8.8) . سمحت الثغرة لأي مستخدم موثق لديه صلاحية الدفع (push) بتنفيذ أوامر تعسفية على الخوادم الخلفية لـ GitHub باستخدام أمر git push واحد، مما يمنح وصولاً كاملاً للقراءة/الكتابة إلى المستودعات الخاصة . أبلغت Wiz عنها لـ GitHub في 4 مارس 2026 من خلال برنامج مكافآت الثغرات . استنسخت GitHub المشكلة في 40 دقيقة، وطبقت إصلاحاً على github.com في أقل من ساعتين، وأكدت عدم وجود أي استغلال في البرية .
مكافأة 100,000 دولار. أصدرت GitHub مكافأة بقيمة 100,000 دولار لهذا الاكتشاف — وهي واحدة من أكبر المدفوعات في تاريخ البرنامج، على الرغم من أن المكافأة الإجمالية لـ Wiz ربما تمت هيكلتها وفقاً لمعدلات ما قبل يوليو 2026 قبل تقليص البرنامج العام .
هذه هي القصة المعمارية الأساسية. Atlas ليس نموذج ذكاء اصطناعي واحد — بل هو نظام وكيل متعدد النماذج . إليك كيف يختلف عن نهج النموذج الأحادي المستخدم من قبل GPT-5.5 Cyber وMythos:
| الخاصية | مشروع Atlas (متعدد الوكلاء) | GPT-5.5 Cyber / Mythos (نموذج أحادي) |
|---|---|---|
| الهندسة | ينسق العديد من وكلاء الذكاء الاصطناعي المتخصصين (وكلاء فرعيون لتحليل الأكواد، الفازينغ، التحليل الثابت، تتبع التبعيات) يعملون بالتوازي | نموذج لغوي كبير واحد مدرب لمهام سيبرانية، يعمل بمفرده |
| تنوع النماذج | يجمع بين عدة نماذج متطورة (مثل Claude Opus 4.6 + GPT-5.5 في تشغيله المؤهل على CyberGym) — يختار أفضل نموذج لكل مهمة فرعية | مرتبط بعائلة نموذج واحدة ومجموعة أوزان واحدة |
| سير العمل | يتم التحقق من كل اكتشاف بشكل مستقل بواسطة وكيل تحقق منفصل، مما يلغي عملياً النتائج الإيجابية الكاذبة | مخرجات نموذج واحد، يصعب التحقق منها ذاتياً |
| قابلية التوسع | يمكنه تشغيل مئات الوكلاء عبر آلاف الأهداف في وقت واحد | محدود بإنتاجية استدلال النموذج الواحد |
| الرؤية الأساسية | "أفضل بنية نموذجية لأبحاث الثغرات ليست نموذجاً واحداً — بل فريق منسق من النماذج ذات التخصصات المميزة" | نهج النموذج الواحد يصطدم بسقف في سير العمل المعقد متعدد الخطوات |
تجادل Wiz بأن هندسة النظام أهم من قدرة النموذج الخام — تفوق Atlas على GPT-5.5 Cyber وMythos ليس بامتلاكه نموذجاً أساسياً أفضل، بل من خلال الجمع الذكي بين نماذج ووكلاء متعددين مع حلقات تحقق محكمة .
يظهر الجدول الزمني لسباق تسلح الذكاء الاصطناعي الأمني مساراً واضحاً من هيمنة النموذج الأحادي إلى تفوق النظم متعددة الوكلاء:
أوائل إلى منتصف 2026: تصعيد النموذج الأحادي. أصدرت OpenAI النسخة الكاملة من GPT-5.5-Cyber (85.6% على CyberGym) في يونيو 2026 كجزء من برنامجها الدفاعي Daybreak . كما سجل نموذج Claude Mythos Preview من Anthropic درجات عالية، مما دفع باحثي معهد AISI البريطاني و Palo Alto Networks إلى التحذير من أن النماذج قد "تجاوزت معايير الاختراق المستقل" .
مايو 2026: النظام متعدد الوكلاء يثبت إمكاناته. أظهر نظام MDASH من Microsoft (أكثر من 100 وكيل متخصص، 88.45% على CyberGym) أن الأنظمة متعددة الوكلاء يمكنها التفوق على النماذج الأحادية .
يوليو 2026: النظام متعدد الوكلاء ينتصر. تفوق Atlas من Wiz (90.9%) عليهما معاً، مثبتاً أن تنسيق نماذج متطورة متعددة يتفوق على أي نموذج واحد .
إن الجمع بين وكلاء الذكاء الاصطناعي مع الفازينغ المنهجي والتحليل الثابت ومراجعة الأكواد ينتج ثغرات صفرية على نطاق غير مسبوق — وجد Atlas وحده أكثر من 200 في أكواد مفتوحة المصدر خضعت لتدقيق مكثف . هذا الطوفان من الثغرات التي اكتشفها الذكاء الاصطناعي يضغط على اقتصاديات برامج الإفصاح عن الثغرات. خفضت GitHub مدفوعات برنامج مكافآت الثغرات العام بمقدار النصف على الأقل في 27 يوليو 2026 (انخفضت الاكتشافات الحرجة من 20,000-30,000 دولار+ إلى 10,000 دولار ثابتة)، بينما لا تزال الطبقة المتميزة (VIP) الخاصة بالدعوات فقط تدفع 30,000 دولار+ . البلاغات المقدمة قبل هذا التاريخ، بما في ذلك CVE-2026-3854 الذي اكتشفه Atlas، احتفظت بشروط الدفع السابقة .
يمثل مشروع Atlas من Wiz أحدث ما توصلت إليه أبحاث الثغرات الأمنية المعتمدة على الذكاء الاصطناعي — ليس لأنه يستخدم نموذجاً أفضل، ولكن لأن بنيته متعددة الوكلاء والنماذج مع التحقق المستقل تتفوق على أنظمة النموذج الأحادي بفارق كبير (90.9% مقابل 85.6% و83%). يعكس هذا تحولاً أوسع في مشهد أمن الذكاء الاصطناعي من سؤال "أي نموذج هو الأفضل" إلى "كيف تنسق النماذج بفعالية". كما يوضح موقف Wiz وGoogle، فإن النهج الفائز في سباق تسلح الذكاء الاصطناعي الأمني لن يكون نموذجاً خارقاً واحداً، بل أنظمة تجمع بين النماذج والخبرة البشرية وخطوط أنابيب التحقق الصارمة .