باحثو الأمن السيبراني ينتقدون نموذج Claude Fable 5 من أنثروبيك بسبب حواجز حماية مفرطة تحظر حتى الاستفسارات الأمنية البريئة وتتحول بصمت إلى نموذج أضعف دون إخبار المستخدم، مما يجعل النموذج 'غير صالح للاستخدام' في الأعما... يكمن جوهر الانتقاد في آلية تصنيف تعيد توجيه الطلبات المتعلقة بالأمن السيبراني والأحياء والكيمياء...

Create a landscape editorial hero image for this Studio Global article: What is causing cybersecurity professionals to criticize Anthropic's Claude Fable 5, and how does the model's safety guardrail system work,. Article summary: Anthropic released Claude Fable 5 on June 9, 2026 as a guardrailed public version of its powerful Mythos-class model, alongside an unrestricted twin, Claude Mythos 5, available only to vetted partners through Project Gla. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Claude Fable 5: Why Anthropic Put Its Most Powerful AI Behind Guardrails. * Anthropic released Claude Fable 5 on 9 June 2026. It is the first publicly available Mythos-class mode" source context "Claude Fable 5: Anthropic Locks Down Cyber and Bio" Reference image 2: visual subject "# Anthropic says these topics
في التاسع من يونيو 2026، أطلقت شركة أنثروبيك (Anthropic) نموذجها الأحدث والأقوى للعامة، Claude Fable 5. لكن بدلاً من الاحتفاء، قوبل الإطلاق بموجة عارمة من الانتقادات من مجتمع الأمن السيبراني. بينما تقدم الشركة النموذج كإصدار 'مسؤول' من تقنيتها فائقة التطور من فئة 'ميثوس' (Mythos-class)، يرى خبراء الأمن أن حواجز الحماية المدمجة صارمة جدًا لدرجة أنها تجعل النموذج عديم الفائدة عمليًا لأعمال البحث والدفاع المشروعة .
جوهر المشكلة ليس وجود ميزات الأمان بحد ذاتها، بل الطريقة التي طُبقت بها: بصمت، وبشكل واسع، ومع آلية احتياطية تستبدل النموذج بآخر أقل ذكاءً دون علم المستخدم. إليكم تفصيل للجدل القائم والتقنية التي تقف خلفه.
الشكوى الأساسية للباحثين هي الحساسية المفرطة لمصنفات المحتوى في Fable 5. وصفت فالنتينا 'تشومبي' بالميوتي، الباحثة الأمنية البارزة في فريق IBM X-Force، الوضع لموقع TechCrunch بقولها: 'يرفض [Fable 5] أي طلب يمكن أن يكون له علاقة ولو بشكل عرضي بالأمن السيبراني – حتى المهام غير الضارة مثل قراءة منشور مدونة' . هذا يعني أن طلبات المساعدة لفهم مفاهيم أساسية في الأمن السيبراني يتم حظرها، وليس فقط الطلبات الخطيرة.
لهذا الحظر المفرط تأثير سلبي مباشر على فائدة النموذج. عندما يتم الإبلاغ عن استفسار، يتلقى المستخدم ردًا مخففًا من نموذج ذكاء اصطناعي أقدم، وهو تحويل لا يتم إبلاغه به صراحةً . تتفاقم المشكلة بسبب كيفية الكشف عن هذه المعلومة؛ يقول النقاد إن هذا السلوك لم يُكشف عنه إلا مدفونًا في عمق 'بطاقة نظام' (System Card) تقع في 319 صفحة، مما أدى إلى اتهامات بأن أنثروبيك انخرطت في 'تخريب سري' لقدرات النموذج لبعض المستخدمين
.
لا تقتصر القيود على الأمن السيبراني. تستهدف حواجز الحماية أيضًا الاستفسارات المتعلقة بعلم الأحياء والكيمياء، وبشكل حاسم، 'تقطير' نماذج الذكاء الاصطناعي (أي استخدام مخرجات نموذج لتدريب نموذج آخر). هذه النقطة الأخيرة غذت موجة منفصلة من الانتقادات، حيث يتهم بعض المطورين أنثروبيك باستخدام 'السلامة' كذريعة لسلوك مانع للمنافسة من خلال منع مطوري الذكاء الاصطناعي الآخرين من استخدام مخرجات Fable 5 للتدريب .
نظام الأمان في Fable 5 ليس مجرد آلية رفض بسيطة، بل هو نظام توجيه مصمم ليفشل بهدوء . تعمل هيكلية النظام في ثلاث خطوات:
تشير أنثروبيك إلى أن هذه المصنفات تنشط في أقل من 5% من جميع الجلسات في المتوسط . وقد أقرت الشركة علنًا بمشكلة الإبلاغ المفرط. أخبر متحدث باسم الشركة موقع Business Insider أن إجراءات السلامة 'قد تبلغ عن طلبات آمنة أو محايدة أو عادية'، لكنه برر ذلك كحل وسط ضروري لإطلاق نموذج بهذه القدرات الأساسية القوية للعامة
.
موقف أنثروبيك هو أن حواجز الحماية المتحفظة هي خيار متعمد ومسؤول، وليست خطأ برمجياً. تجادل الشركة بأن نموذج 'ميثوس' الأساسي يتقن مهاماً مثل إيجاد واستغلال الثغرات البرمجية لدرجة أن الإطلاق العام غير المقيد قد يشكل خطراً غير مقبول لسوء استخدام كارثي .
تعتبر حواجز الحماية، من وجهة نظرهم، حلاً وسطًا تصميميًا - طريقة لتزويد الجمهور بإمكانية الوصول إلى نموذج متطور في التفكير والترميز والكتابة مع وضع 'صندوق رملي' حول أخطر قدراته المحتملة . إنهم يصورون الإبلاغ المفرط على أنه تكلفة مؤقتة لإطلاق نموذج قوي 'بأمان وسرعة'، مع التزام بتحسين المصنفات مع مرور الوقت
.
لا يمكن فهم إطلاق Claude Fable 5 بمعزل عن الآخرين. إنه نصف استراتيجية نشر ذات مستويين أصبحت معيارًا صناعيًا جديدًا لنماذج الذكاء الاصطناعي المتطورة .
في نفس اليوم الذي أُطلق فيه Fable 5، أعلنت أنثروبيك أيضًا عن Claude Mythos 5. يشترك كلا النموذجين في نفس الهندسة الأساسية والأوزان (weights) بالضبط - إنهما نفس 'العقل'. الفرق الوحيد هو إعدادات الأمان. تمت إزالة المصنفات من Mythos 5 في المجالات الحساسة، مما يمنحه قدراته الكاملة غير المقيدة .
مع ذلك، فإن Mythos 5 ليس للعامة. إنه مقصور على مجموعة صغيرة من الشركاء الموثوقين، بما في ذلك الوكالات الحكومية ومشغلي البنى التحتية الحيوية، من خلال مبادرة تسمى مشروع الجناح الزجاجي (Project Glasswing) . أُطلق هذا البرنامج المدعوم من الحكومة الأمريكية مبدئيًا مع 12 شريكًا مؤسسًا، بما في ذلك عمالقة التكنولوجيا مثل AWS و Google و Microsoft، للسماح لـ'المدافعين السيبرانيين' باستخدام الذكاء الاصطناعي لإيجاد وإصلاح الثغرات البرمجية على نطاق واسع
. مع إطلاق Mythos 5، تم توسيع نطاق الوصول ليشمل حوالي 40 منظمة
.
يوضح الجدول أدناه الانقسام الأساسي:
يُعتبر انقسام Fable/Mythos من أنثروبيك المثال الأكثر وضوحًا لما يمكن تسميته بـ نشر الذكاء الاصطناعي القائم على مستويات القدرات. في هذا النموذج الجديد، لا يكون الذكاء الاصطناعي المتطور منتجًا واحدًا. قوته الكاملة هي امتياز، وليست أمرًا مسلمًا به، وحواجز الأمان هي الآلية التي تخلق تمايزًا في المنتج .
هذا النمط ليس فريدًا في أنثروبيك. تبنت شركات رائدة أخرى في مجال الذكاء الاصطناعي، بما في ذلك OpenAI، نهجًا مماثلاً من خلال توفير إصدارات مقيدة الوصول من أكثر نماذجها تقدمًا لشركاء الأمن القومي والبحث . إن إطلاق Fable/Mythos يبلور مستقبلًا تكون فيه أقوى قدرات الذكاء الاصطناعي محجوبة ليس بسبب التكنولوجيا، ولكن بسبب حالة 'الفحص الأمني'، حيث تتضاعف بروتوكولات السلامة كآليات للتحكم في الوصول، وهو نهج يثير بالفعل نقاشًا أوسع حول المركزية والإنصاف والمعنى الحقيقي لـ'سلامة' الذكاء الاصطناعي العام.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
باحثو الأمن السيبراني ينتقدون نموذج Claude Fable 5 من أنثروبيك بسبب حواجز حماية مفرطة تحظر حتى الاستفسارات الأمنية البريئة وتتحول بصمت إلى نموذج أضعف دون إخبار المستخدم، مما يجعل النموذج 'غير صالح للاستخدام' في الأعما...
باحثو الأمن السيبراني ينتقدون نموذج Claude Fable 5 من أنثروبيك بسبب حواجز حماية مفرطة تحظر حتى الاستفسارات الأمنية البريئة وتتحول بصمت إلى نموذج أضعف دون إخبار المستخدم، مما يجعل النموذج 'غير صالح للاستخدام' في الأعما... يكمن جوهر الانتقاد في آلية تصنيف تعيد توجيه الطلبات المتعلقة بالأمن السيبراني والأحياء والكيمياء وتقطير الذكاء الاصطناعي إلى نموذج Claude Opus 4.8 الأقدم، وهو أمر يقول النقاد إنه دُفن في بطاقة نظام من 319 صفحة ويمثل '...
إطلاق نموذج عام مقيد (Fable 5) جنبًا إلى جنب مع نموذج غير مقيد للشركاء الموثوقين (Mythos 5) يشير إلى معيار صناعي جديد لنشر الذكاء الاصطناعي القائم على 'مستويات القدرات'، مما يثير تساؤلات حول الشفافية والإنصاف وما إذا...