تقول OpenAI إن GPT‑6 Astra يرتكب أخطاء واقعية أقل ويقاوم كسر الحواجز الأمنية وحقن الأوامر بصورة أفضل من GPT‑5.6 Sol، بما يشمل مسارات الهجوم الأطول متعددة الخطوات. أفادت ساحة IPI من Gray Swan بأن أياً من النماذج المختبرة لم يكن محصناً من حقن الأوامر الخفي؛ وشملت الاختبارات 13 نموذجاً متقدماً و41 سيناريو للوكلاء وأكثر...
نشر بواسطةتم التحرير باستخدام GPT-5.6 Terraتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: How does OpenAI’s GPT-6 Astra, released September 3, compare with GPT-5.6 Sol and Anthropic’s Claude Opus 5 on factual-error reduction, resi. Article summary: GPT‑6 Astra is a substantial improvement over GPT‑5.6 Sol on OpenAI’s internal factuality and jailbreak-robustness evaluations, including longer, multi-turn attack trajectories. But this is not evidence of immunity: inde. Topic tags: general, general web, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
تقدم GPT‑6 Astra، وفقاً لتقييمات OpenAI، تحسناً واضحاً عن GPT‑5.6 Sol في جوانب السلامة: أخطاء واقعية أقل، ومقاومة أعلى لحقن الأوامر، وصلابة أكبر أمام محاولات «كسر الحواجز» (jailbreaks)، بما فيها الهجمات التي تتطور عبر محادثات أو خطوات طويلة. 25
30
لكن هذا لا يعني أن الوكيل المدعوم بالذكاء الاصطناعي أصبح محصناً. فتحسن سلوك النموذج لا يمنع تلقائياً التعليمات العدائية المخبأة في صفحة ويب أو بريد إلكتروني أو مستند أو مستودع برمجي أو مخرجات أداة من التأثير في الوكيل الذي يقرأها. وخلصت اختبارات Gray Swan لحقن الأوامر غير المباشر (IPI) إلى أن أياً من النماذج التي اختبرتها لم يكن محصناً. 4
تقول OpenAI إن Astra «أكثر متانة بدرجة كبيرة» أمام محاولات كسر الحواجز مقارنة بـGPT‑5.6 Sol، بما في ذلك الهجمات ذات المسار الطويل. وهذه نقطة مهمة لأن المهاجم المتقدم لا يحتاج إلى طلب واحد مكشوف؛ إذ يستطيع تعديل أسلوبه على مراحل خلال تفاعل متعدد الأدوار، مستفيداً من السياق المتراكم. 25
وتفيد الشركة أيضاً بأن Astra أقوى في مقاومة حقن الأوامر ضمن بيئات التصفح والعمل، وأنه يرتكب أخطاء واقعية أقل من Sol. لكن ينبغي قراءة مؤشرات الدقة بحذر: فتجارب إعادة إنتاج الأخطاء اعتمدت محادثات كان المستخدمون قد أبلغوا فيها مسبقاً عن إجابات خاطئة، أي إنها حالات مرشحة للأخطاء وليست قياساً مباشراً لمعدل الهلوسة في الاستخدام اليومي. 25
30
وتكتسب هذه التحسينات أهمية خاصة للوكلاء المكلفين بالبحث والبرمجة والتصفح وإنجاز أعمال مركبة متعددة الخطوات. وتصف ملاحظات إصدار OpenAI قدرة Astra على تنفيذ مهام معقدة متعددة المراحل وإنشاء مستندات وجداول بيانات وعروض تقديمية. 19
لا تدعم الأدلة المتاحة حكماً عاماً بأن Astra أكثر أماناً من Claude Opus 5 من Anthropic في الدقة الواقعية أو مقاومة كسر الحواجز المباشر أو حقن الأوامر غير المباشر.
فالمقارنة العادلة بين النماذج تتطلب مجموعة اختبارات موحدة، وأدوات وكلاء متطابقة، وتعليمات نظام متماثلة، وتعريفاً مشتركاً لنجاح الهجوم، ومهاجماً قادراً على التكيف بالطريقة نفسها. وقد تختلف تقييمات الشركات وتحديات الاختبار العلنية في كل هذه العوامل. وتذكر مواد Gray Swan نموذج Claude Opus 5 ضمن النماذج المتاحة في ساحة الاختبار، لكن النتائج المقدمة لا تتضمن بطاقة نقاط مباشرة ومتكافئة بين Astra وOpus 5. 1
4
لذلك فالخلاصة التي يمكن الدفاع عنها أضيق: أقوى دليل لدى OpenAI هو أن Astra تحسن على سلفه GPT‑5.6 Sol.
يبدأ كسر الحواجز المباشر بطلب ظاهر يقدمه المهاجم للنموذج، مثل محاولة تجاوز قواعده أو دفعه إلى تنفيذ فعل محظور. وترتبط مكاسب Astra المعلنة في مواجهة مسارات الهجوم الطويلة بهذا النوع من الخصوم المستمرين والمتكيفين. 25
أما حقن الأوامر غير المباشر فيأتي من المحتوى الذي يستهلكه الوكيل. فقد تُخفى تعليمات ضارة داخل صفحة ويب أو رسالة بريد أو وثيقة أو نتيجة بحث أو أثر تنفيذ برمجي أو مخرجات أداة، بهدف تحويل الوكيل عن مهمة المستخدم الفعلية. وركز تحدي IPI لدى Gray Swan تحديداً على هذه الأوامر المخفية في بيئات واقعية، منها محتوى الويب ومخرجات الأدوات وآثار وكلاء البرمجة. 5
وهنا تكمن الخطورة: قد لا يرى الشخص الذي يستخدم الوكيل التعليمة الخبيثة أصلاً.
أعلنت Gray Swan نتائج ساحة IPI شملت 13 نموذجاً متقدماً، و464 مختبِراً أمنياً، و41 سيناريو، وأكثر من 272 ألف محاولة هجوم. وكانت خلاصتها أن أياً من النماذج المختبرة لم يخرج محصناً من حقن الأوامر غير المباشر. 4
وهذا دليل قوي على أن المشكلة لا تزال غير محلولة في نشر الوكلاء. لكنه ليس جدول ترتيب محايداً ومكتملاً بين المورّدين في جميع أبعاد السلامة. فلا تعني النتيجة أن جميع النماذج تفشل بالمعدل نفسه، ولا تغني عن تقييمات خاصة بكل نموذج لقياس الدقة أو مقاومة كسر الحواجز المباشر.
في مساعد دردشة مستقل، قد ينتهي حقن الأوامر الناجح إلى إجابة مضللة. أما في وكيل مؤسسي متصل بأنظمة العمل، فقد تكون العواقب أكبر بكثير.
تصنف OpenAI نموذج Astra عند مستوى «حرج» في قدرات الأمن السيبراني ضمن إطارها للاستعداد. ووفقاً للشركة، يستطيع Astra، إذا زُوّد بالأدوات والصلاحيات المناسبة، اكتشاف ثغرات أمنية غير معروفة سابقاً وتطوير أساليب لاستغلالها عبر كثير من الأنظمة المحمية جيداً، من دون إرشاد بشري خطوة بخطوة. 27
يمكن أن تفيد هذه القدرة في الدفاع المصرح به. لكنها ترفع أيضاً كلفة اختراق سير عمل وكيل: فالمهاجم الذي ينجح في إعادة توجيه الوكيل عبر محتوى غير موثوق قد يحاول التأثير في ما يبحث عنه الوكيل، أو الأدوات التي يستدعيها، أو الأفعال التي يقترحها. ويزداد الخطر عندما يمتلك الوكيل وصولاً إلى بيانات حساسة أو مستودعات برمجية أو بيئات سحابية أو متصفحات أو تطبيقات أعمال.
ينبغي التعامل مع مقاومة حقن الأوامر بوصفها طبقة دفاع، لا كحد أمني وحيد. وفي سير العمل ذي الأثر الكبير، على المؤسسات أن:
وقد وصفت OpenAI العزل الأقوى، وتقييد الوصول إلى الشبكة والأدوات، والمراقبة، والتنفيذ ضمن بيئات معزولة، بوصفها ضمانات للأنظمة الأعلى قدرة. 34
تشير بيانات OpenAI إلى أن Astra، بفضل انخفاض أخطائه الواقعية وتحسن مقاومته لكسر الحواجز المباشر، هو خليفة أقوى لـGPT‑5.6 Sol. 25
30 لكن لا تدعم الأدلة المقدمة إعلان تفوقه المطلق على Claude Opus 5 في كل السياقات، كما أن حقن الأوامر غير المباشر يظل نقطة ضعف مؤثرة في منظومة الوكلاء.
4
والدرس العملي للمؤسسات بسيط: اختر النموذج الأقوى المتاح، لكن صمم النظام المحيط به بحيث لا تتحول وثيقة أو صفحة ويب خبيثة إلى قناة يتحكم عبرها المهاجم في قدرات النموذج وأدواته المتصلة.
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
تقول OpenAI إن GPT‑6 Astra يرتكب أخطاء واقعية أقل ويقاوم كسر الحواجز الأمنية وحقن الأوامر بصورة أفضل من GPT‑5.6 Sol، بما يشمل مسارات الهجوم الأطول متعددة الخطوات.
تقول OpenAI إن GPT‑6 Astra يرتكب أخطاء واقعية أقل ويقاوم كسر الحواجز الأمنية وحقن الأوامر بصورة أفضل من GPT‑5.6 Sol، بما يشمل مسارات الهجوم الأطول متعددة الخطوات. أفادت ساحة IPI من Gray Swan بأن أياً من النماذج المختبرة لم يكن محصناً من حقن الأوامر الخفي؛ وشملت الاختبارات 13 نموذجاً متقدماً و41 سيناريو للوكلاء وأكثر من 272 ألف محاولة هجوم.
لا تقدم المواد المتاحة مقارنة موحّدة كافية لحسم ترتيب نهائي بين Astra وClaude Opus 5 في الدقة أو مقاومة كسر الحواجز أو حقن الأوامر غير المباشر.