يمكن للوكلاء المستقلين الذين ينفذون المراجحة أن يتعرضوا لهجمات "الساندويتش" أو التقدم عليهم من قبل روبوتات MEV العدائية. استنزفت هجمات القروض السريعة 2.4 مليار دولار من بروتوكولات DeFi في عام 2026—بزيادة 340% عن العام السابق—حيث استخدمت الروبوتات المحسّنة بالذكاء الاصطناعي مسارات المراجحة كأسلحة .
الوكلاء الذين يحتفظون بمفاتيح خاصة، ويحللون بيانات السوق، ويقدمون المعاملات بشكل مستقل، يخلقون فئة جديدة من مخاطر العقود. يمكن تدقيق البروتوكول بشكل خالٍ من العيوب على مستوى Solidity (لغة العقود الذكية) ومع ذلك يفقد الأموال لأن الجهة الفاعلة المميزة هي نموذج لغوي يمكن التلاعب به عبر النصوص .
مكنت نماذج الذكاء الاصطناعي (مثل Claude Opus 4.8 من Anthropic) الباحثين الأمنيين والمهاجمين على حد سواء من اكتشاف ثغرات حرجة بشكل أسرع. وجدت Shielded Labs خطأً في مجمع Orchard الخاص بـ Zcash كان موجودًا منذ مايو 2022 باستخدام وكيل ذكاء اصطناعي . الجماعات المرتبطة بكوريا الشمالية—المسؤولة عن 66% من إجمالي خسائر اختراقات العملات الرقمية (643 مليون دولار) في النصف الأول من 2026—تستخدم بشكل متزايد الذكاء الاصطناعي لأتمتة اكتشاف الثغرات
.
ثغرة أمنية حرجة (CVSS 10.0) في مكونات خادم React (CVE-2025-55182) سمحت للمهاجمين بتحقيق تنفيذ التعليمات البرمجية عن بعد على خوادم الواجهة الأمامية للتطبيقات اللامركزية (DApps) التي تعمل كوكلاء توقيع للوكلاء المحليين، مما يعترض مفاتيح الجلسة .
تتراوح توقعات الخسائر السنوية لاستغلال العقود الذكية المدعوم بالذكاء الاصطناعي بين 10 مليارات و20 مليار دولار بحلول عام 2027 إذا استمرت الاتجاهات الحالية .
سلطة النقد في سنغافورة (MAS) — في أغسطس 2026، أكدت سلطة النقد السنغافورية أن الذكاء الاصطناعي الوكيلي مشمول بقواعدها المصرفية الملزمة والمبادئ التوجيهية القادمة لإدارة مخاطر الذكاء الاصطناعي (التي بدأت مشاوراتها في نوفمبر 2025). كما تقوم MAS ببناء بنية تحتية عملية من خلال مشروع MindForge .
وزارة الخزانة الأمريكية—إطار إدارة مخاطر الذكاء الاصطناعي للخدمات المالية (FS AI RMF) — إطار عمل (فبراير 2026) يوفر هيكل حوكمة قائم على المخاطر للذكاء الاصطناعي في الخدمات المصرفية والمالية .
قانون الذكاء الاصطناعي للاتحاد الأوروبي + MiCA — اعتبارًا من أغسطس 2026، لا يوجد دليل امتثال واحد ونهائي لوكلاء الذكاء الاصطناعي في الاتحاد الأوروبي. يجب على المؤسسات تجميع المتطلبات من قانون الذكاء الاصطناعي للاتحاد الأوروبي ولائحة أسواق الأصول المشفرة .
هيئة تطوير الإعلام السنغافورية (IMDA)—إطار الحوكمة النموذجي للذكاء الاصطناعي الوكيلي — تم نشره في أغسطس 2026، ويتطلب تقييمًا مسبقًا للمخاطر، وضوابط فنية عبر دورة حياة الوكيل، وإشرافًا بشريًا يتناسب مع مستوى الاستقلالية .
تحالف أمن السحابة—إطار مستويات الاستقلالية والتحكم — خمسة مبادئ رئيسية: يجب تبرير الاستقلالية صراحة، الاستقلالية الأعلى تتطلب ضوابط أقوى، الإشراف البشري يتناسب مع المخاطر، المراقبة المستمرة، والمساءلة الواضحة .
محرك سياسات حتمي للتحقق من الإجراءات. تعامل مع جميع المحتويات المقدمة من المستخدم والمسترجعة على أنها غير موثوقة. تحقق من كل إجراء مقترح للوكيل مقابل محرك سياسات حتمي—التنقية المدخلة وحدها لا يمكنها إزالة التعليمات العدائية .
بوابات موافقة "الإنسان في الحلقة" لأي إجراءات عالية القيمة أو عالية المخاطر قبل التنفيذ .
الفصل بين الواجبات، حدود الموافقة، ومراجعات الوصول — طبّق نفس مبادئ الرقابة المالية المستخدمة مع المشغلين البشريين (مثل التفويض المزدوج للتحويلات الكبيرة) على وكلاء الذكاء الاصطناعي .
تصفية المحتوى ومراقبة المخرجات للأوامر العدائية وأنماط السلوك الشاذة .
تحديد مستوى الاستقلالية — لا ينبغي منح الوكلاء أقصى درجات الاستقلالية افتراضيًا؛ استقلالية أقل مع مسارات تصعيد واضحة للإجراءات عالية القيمة .
تدقيق خاص بالوكيل وإنفاذ الثوابت (Invariants) — بالإضافة إلى تدقيق العقود الذكية القياسي، تحتاج الوكلاء إلى مراقبات وقت التشغيل التي تتحقق من الإجراءات مقابل الثوابت المحددة مسبقًا وقواطع الدائرة .
تنقية المدخلات الواعية بالسياق وعزل الذاكرة — لمنع حقن الأوامر عبر خلاصات البيانات الخارجية أو وحدات ذاكرة الوكيل .
هندسة حوكمة من أربع طبقات (مقترحة في الأبحاث الأكاديمية): وحدات ذاتية التنظيم بجانب كل نموذج، حوكمة نماذج داخلية، إشراف مركزي، وإبلاغ تنظيمي خارجي .