سرعان ما انتشرت هذه الادعاءات بشكل واسع، لكن القصة الكاملة أكثر تعقيدًا. الأدلة العامة تدعم اكتشافًا أضيق نطاقًا — وإن كان لا يزال مهمًا — وتشير عوامل متعددة إلى أن مطوري Redis ومحللي الأمن المستقلين يشككون في النطاق الأوسع للادعاءات.
تغطي أكواد PoC التي نشرها Bera Buddies مسارين للاستغلال :
تتطلب سلسلتي الاستغلال الأمر RESTORE، وتستخدم بعضها أيضًا أوامر EVAL وXGROUP ووحدة RedisBloom . أصدرت Redis سبعة تحديثات أمنية في 23 يوليو لمعالجة هذه الثغرات . توصف أكواد الاستغلال بأنها غير تخريبية، وتم نشرها ضد صور Docker الرسمية لـ Redis .
أدت عدة عوامل مهمة إلى شكوك واسعة النطاق:
تضخيم النطاق بدون دليل. الأدلة العامة تدعم استغلالًا خطيرًا واحدًا في Redis 8.8.0، وليس الـ 19 ثغرة يوم-صفر المدعاة. هذا العدد والجدول الزمني المبلغ عنه لا يزالان غير مؤكدين من قبل أي جهة مستقلة .
لا يوجد تخصيص CVE مؤكد. ادعاء الـ 27 دقيقة ليس لديه تخصيص CVE مؤكد. إنه حدث منفصل عن خمس CVEs تم تصحيحها ونُسبت من قبل Redis إلى باحثين بشريين بأسمائهم (CVE-2026-23479، CVE-2026-25243، CVE-2026-25588، CVE-2026-25589، وCVE-2026-23631، والتي تم تصحيحها في 5 مايو 2026). الخلط بين هذين الحدثين يوصف بأنه "أكبر خطأ في التغطية الإخبارية" .
إعادة اكتشاف ثغرات معروفة. تصف بعض التقارير أن Kimi K3 "أعاد اكتشاف ثغرة Redis معروفة" كانت قد صُححت بالفعل في Redis 8.8.0 . أشار أحد التحليلات إلى أن اختبار الوكيل "ربط بين مشكلات أمان ذاكرة معروفة بدلاً من اكتشاف ثغرات جديدة منعزلة" .
اتصال النموذج بالإنترنت أثناء التجربة. أكد الباحث أن النموذج كان متصلاً بالإنترنت أثناء الاختبار. يجادل النقاد بأن هذا يعني أن النموذج كان بإمكانه الوصول إلى معلومات عن ثغرات موجودة أو أكواد استغلال، مما يضعف ادعاء الاكتشاف المستقل تمامًا .
تقييم حكومي بريطاني/أمريكي يتناقض مع الادعاءات. وجد تقييم أولي مشترك من UK AISI / CAISI أن Kimi K3 "يؤدي بشكل أقل بكثير من أحدث النماذج القادرة على الهجمات السيبرانية الحدودية" في مهام الهجوم السيبراني المستقلة . عندما طُلب منه مهاجمة شبكة شركة محاكاة، وصل Kimi K3 في المتوسط إلى الخطوة 17 من مسار هجوم من 32 خطوة، بينما وصلت النماذج الأمريكية الأكثر قدرة إلى 28.5 خطوة . كما أن إجراءات السلامة في النموذج "لم تمنعه من محاولة الاستغلال السيبراني" .
لم يتم التحقق منها بشكل مستقل. ادعاءات Shou لم يتم التحقق منها بشكل مستقل من قبل مطوري Redis أو Moonshot AI، ولا تزال غير مؤكدة .
بغض النظر عن النطاق الدقيق لادعاءات Shou، فإن هذا العرض له تداعيات كبيرة:
انخفاض جذري في زمن تطوير الاستغلال. يضغط وكلاء الذكاء الاصطناعي بشكل حاد على الجدول الزمني بين مراجعة الكود المصدري وإنتاج استغلال عملي، مما قد يقلص النافذة المتاحة للمدافعين للتحقق من التحديثات الأمنية ونشرها .
مخاطر انتشار النماذج مفتوحة الأوزان. Kimi K3 هو نموذج مفتوح الأوزان بـ 2.8 تريليون معلمة، ومن المقرر إطلاقه الكامل في 27 يوليو . على عكس النماذج المقيدة بواجهات برمجية API، سيسمح هذا لأي شخص بتنزيل النموذج وضبطه بدقة ودمجه في أدوات مخصصة دون رقابة، مما يخفض الحاجز أمام الاستخدام الهجومي .
القدرة لا تزال غير ناضجة على المستوى الحدودي. يشير التقييم الحكومي المشترك والمعايير المستقلة إلى أن القدرة الحالية على الاستغلال المستقل لا تزال في مراحلها المبكرة . يؤدي Kimi K3 أداءً جيدًا في استدلال الكود وإعادة اكتشاف الثغرات — فقد أعاد اكتشاف 23 من أصل 26 CVE معروفة على معيار متخصص — لكنه يتخلف عن أفضل النماذج في الهجمات المستقلة كاملة السلسلة على شبكات واقعية . في اختبار مستقل، سجل Kimi K3 32.2% في اختبار أمن سيبراني هجومي، أي أقل من نصف متوسط 76.2% الذي حققته النماذج الأمريكية الرائدة، وفشل في تحقيق تنفيذ أوامر عشوائي على أي من 41 ثغرة تم اختبارها .
إلحاح دفاعي جديد. أدى هذا العرض إلى تسريع الدعوات لأتمتة تحديد أولويات التصحيحات، وأدوات التحليل الثنائي في الوقت الفعلي، وضوابط أكثر صرامة حول إصدار النماذج عالية القدرة مفتوحة الأوزان . تواجه صناعة الأمن السيبراني الآن مستقبلًا تتقلص فيه نافذة الانتقال من الثغرة إلى الاستغلال من أشهر إلى دقائق ، ويمكن لوكلاء الذكاء الاصطناعي العمل بسرعة آلية عبر أهداف متعددة في وقت واحد .