يختبر هذا المعيار التخطيط واستخدام الأدوات والقدرة الوكيلية في سطر الأوامر — وهو "اختبار قاسٍ" لقدرة النموذج على العمل بشكل مستقل في بيئة طرفية Y. النتائج المذكورة:
| النموذج | درجة Terminal-Bench 2.1 |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% BI |
| GPT-5.6 Sol | 88.8% B |
| Claude Mythos 5 | 88.0% I |
| GPT-5.5 | 83.4% BI |
تمثل درجة Sol Ultra البالغة 91.9% قفزة كبيرة — حوالي 4 نقاط مئوية أمام أفضل نموذج من Anthropic وأكثر من 8 نقاط أمام GPT-5.5 BI.
تصنف OpenAI النماذج الثلاثة GPT-5.6 بأنها "عالية" في كل من مخاطر الأمن السيبراني والبيولوجي، لكن لا شيء منها يعبر عتبة "الحرجة" A.
| النموذج | الإدخال ($/1M رمز) | الإخراج ($/1M رمز) | الدور |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | الرائد — التفكير المعقد، البرمجة، الأمن السيبراني، العمل الوكيلي طويل الأمد |
| GPT-5.6 Terra | $2.50 | $15.00 | المتوازن — أداء مشابه لـ GPT-5.5 بنصف التكلفة |
| GPT-5.6 Luna | $1.00 | $6.00 | الحجمي — الأسرع والأكثر كفاءة من حيث التكلفة للتصنيف والاستخراج والتوجيه |
قدمت OpenAI أيضاً التخزين المؤقت لـ GPT-5.6. تُحتسب عمليات كتابة ذاكرة التخزين المؤقت بمعدل 1.25 ضعف معدل الإدخال غير المخزن للنموذج، بينما تحصل عمليات قراءة ذاكرة التخزين المؤقت على خصم 90% على الرموز المدخلة المخزنة مؤقتاً. يدعم GPT-5.6 نقاط توقف صريحة لذاكرة التخزين المؤقت وعمر تخزين مؤقت أدنى يبلغ 30 دقيقة H.
السبب الرئيسي: تدخل حكومي أمريكي مباشر. طلبت إدارة ترامب صراحةً من OpenAI تقييد الوصول قبل الإصدار، مستشهدة بمخاوف الأمن القومي TAK. قام مسؤولو البيت الأبيض شخصياً بالموافقة على المنظمات الشريكة المعتمدة البالغ عددها حوالي 20 واحدة تلو الأخرى AI.
اعتبرت الإدارة أن GPT-5.6 يمتلك قدرات "شبيهة بـ Mythos" — في إشارة إلى Claude Mythos من Anthropic، الذي تم تعليقه قسراً في جميع أنحاء العالم من قبل وزارة التجارة في 12 يونيو 2026 بموجب قواعد مراقبة الصادرات A. ينبع تقييد GPT-5.6 من نفس الإطار السياسي.
صرحت OpenAI علناً أن هذا النوع من الحراسة الحكومية "يحرم أفضل الأدوات من المستخدمين والمطورين والشركات والمدافعين السيبرانيين والشركاء العالميين الذين يحتاجون إليها" A.
تقول OpenAI إنها "تخطط لتوسيع نطاق التوفر في أقرب وقت ممكن" لكنها لم تعلن عن موعد للإتاحة العامة H. صرح سام ألتمان أنه يتوقع وصولاً أوسع في "غضون أسابيع" A. تشير بطاقة النظام الخاصة بالشركة: "نحن نؤمن بالوصول الواسع، ونخطط لجعل GPT-5.6 Sol وTerra وLuna متاحة بشكل عام في الأسابيع القادمة" D.
في الوقت الحالي، أقوى نموذج ذكاء اصطناعي أصدرته OpenAI على الإطلاق متاح فقط لمن توافق عليهم واشنطن.