यह बेंचमार्क योजना बनाने, टूल उपयोग और कमांड-लाइन एजेंटिक क्षमता का परीक्षण करता है — यह टर्मिनल वातावरण में स्वायत्त रूप से काम करने की मॉडल की क्षमता की एक 'बेहद कठिन परीक्षा' है Y। रिपोर्ट किए गए स्कोर:
| मॉडल | टर्मिनल-बेंच 2.1 स्कोर |
|---|---|
| GPT-5.6 सोल अल्ट्रा | 91.9% BI |
| GPT-5.6 सोल | 88.8% B |
| क्लॉड मिथोस 5 | 88.0% I |
| GPT-5.5 | 83.4% BI |
सोल अल्ट्रा का 91.9% एक महत्वपूर्ण उछाल है — यह एंथ्रोपिक के सबसे अच्छे मॉडल से लगभग 4 प्रतिशत अंक और GPT-5.5 से 8 से अधिक अंक आगे है BI।
OpenAI तीनों GPT-5.6 मॉडलों को साइबर सुरक्षा और जैविक जोखिम दोनों में 'उच्च' रेट करता है, लेकिन कोई भी 'गंभीर' सीमा को पार नहीं करता A।
| मॉडल | इनपुट ($/1M टोकन) | आउटपुट ($/1M टोकन) | भूमिका |
|---|---|---|---|
| GPT-5.6 सोल | $5.00 | $30.00 | फ्लैगशिप — जटिल तर्क, कोडिंग, साइबर सुरक्षा, दीर्घकालिक एजेंटिक कार्य |
| GPT-5.6 टेरा | $2.50 | $15.00 | संतुलित — आधी कीमत पर GPT-5.5 के प्रदर्शन से मेल खाता है |
| GPT-5.6 लूना | $1.00 | $6.00 | वॉल्यूम — वर्गीकरण, निष्कर्षण, रूटिंग के लिए सबसे तेज़ और सबसे किफ़ायती |
OpenAI ने GPT-5.6 के लिए प्रॉम्प्ट कैशिंग भी शुरू की है। कैश राइट पर मॉडल की अनकैश्ड इनपुट दर से 1.25x शुल्क लगता है, जबकि कैश रीड पर कैश्ड-इनपुट टोकन पर 90% की छूट मिलती है। GPT-5.6 स्पष्ट कैश ब्रेकपॉइंट और 30 मिनट का न्यूनतम कैश जीवन समर्थन करता है H।
प्राथमिक कारण: प्रत्यक्ष अमेरिकी सरकार का हस्तक्षेप। ट्रंप प्रशासन ने राष्ट्रीय सुरक्षा चिंताओं का हवाला देते हुए, OpenAI से रिलीज़ से पहले पहुंच प्रतिबंधित करने का स्पष्ट अनुरोध किया TAK। व्हाइट हाउस के अधिकारियों ने एक-एक करके लगभग 20 अनुमोदित भागीदार संगठनों को मंजूरी दी AI।
प्रशासन ने GPT-5.6 को 'मिथोस-जैसी' क्षमता वाला माना — यह एंथ्रोपिक के क्लॉड मिथोस को संदर्भित करता है, जिसके पूर्ववर्ती (क्लॉड फेबल 5) को 12 जून 2026 को वाणिज्य विभाग द्वारा निर्यात नियंत्रण नियमों के तहत दुनिया भर में जबरन निलंबित कर दिया गया था A। GPT-5.6 प्रतिबंध उसी नीति ढांचे से उपजा है।
OpenAI ने सार्वजनिक रूप से कहा कि इस तरह का सरकारी नियंत्रण 'सर्वोत्तम उपकरणों को उपयोगकर्ताओं, डेवलपर्स, उद्यमों, साइबर रक्षकों और वैश्विक भागीदारों से दूर रखता है जिन्हें उनकी आवश्यकता है' A।
OpenAI का कहना है कि वह 'जल्द से जल्द उपलब्धता का विस्तार करने की योजना बना रहा है' लेकिन उसने कोई सामान्य उपलब्धता तिथि घोषित नहीं की है H। सैम ऑल्टमैन ने कहा है कि उन्हें 'हफ्तों के भीतर' व्यापक पहुंच की उम्मीद है A। कंपनी के सिस्टम कार्ड में लिखा है: 'हम व्यापक पहुंच में विश्वास करते हैं, और हम आने वाले हफ्तों में GPT-5.6 सोल, टेरा और लूना को आम तौर पर उपलब्ध कराने की योजना बना रहे हैं' D।
अभी के लिए, OpenAI द्वारा अब तक जारी किया गया सबसे शक्तिशाली AI मॉडल केवल उन लोगों के लिए उपलब्ध है जिन्हें वाशिंगटन ने मंजूरी दी है।