Bu benchmark, bir modelin terminal ortamında otonom olarak çalışma yeteneğini test eden 'acımasız bir test' olarak tanımlanan planlama, araç kullanımı ve komut satırı ajanlık kabiliyetini ölçüyor Y. Raporlanan skorlar:
| Model | Terminal-Bench 2.1 Skoru |
|---|---|
| GPT-5.6 Sol Ultra | %91.9 BI |
| GPT-5.6 Sol | %88.8 B |
| Claude Mythos 5 | %88.0 I |
| GPT-5.5 | %83.4 BI |
Sol Ultra'nın %91.9'u önemli bir sıçrama anlamına geliyor; Anthropic'in en iyi modelinin yaklaşık 4 puan, GPT-5.5'in ise 8 puandan fazla önünde BI.
OpenAI, üç GPT-5.6 modelini de hem siber güvenlik hem de biyolojik risk açısından 'Yüksek' olarak derecelendiriyor, ancak hiçbiri 'Kritik' eşiğini geçmiyor A.
| Model | Giriş ($/1M token) | Çıkış ($/1M token) | Rolü |
|---|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 | Amiral Gemisi — karmaşık akıl yürütme, kodlama, siber güvenlik, uzun vadeli ajanlık işleri |
| GPT-5.6 Terra | $2.50 | $15.00 | Dengeli — GPT-5.5 performansını yarı fiyatına sunar |
| GPT-5.6 Luna | $1.00 | $6.00 | Hacim — sınıflandırma, çıkarım, yönlendirme için en hızlı ve en uygun maliyetli |
OpenAI, GPT-5.6 için prompt önbellekleme özelliğini de tanıttı. Önbellek yazmaları, modelin önbelleksiz giriş ücretinin 1.25 katı olarak faturalandırılırken, önbellek okumaları önbelleğe alınan giriş tokenlerinde %90 indirim alıyor. GPT-5.6, açık önbellek kesme noktalarını ve 30 dakikalık minimum önbellek ömrünü destekliyor H.
Birincil neden: Doğrudan ABD hükümeti müdahalesi. Trump yönetimi, ulusal güvenlik endişelerini gerekçe göstererek OpenAI'den lansmandan önce erişimi kısıtlamasını açıkça talep etti TAK. Beyaz Saray yetkilileri, onaylanan yaklaşık 20 ortak kuruluşu tek tek belirledi AI.
Yönetim, GPT-5.6'yı Anthropic'in Claude Mythos'una benzer yetenekte gördü. Claude Mythos'un öncülü olan Claude Fable 5, 12 Haziran 2026'da Ticaret Bakanlığı tarafından ihracat kontrol kuralları kapsamında dünya çapında askıya alınmıştı A. GPT-5.6 kısıtlaması da aynı politika çerçevesinden kaynaklanıyor.
OpenAI, bu tür bir hükümet denetiminin 'en iyi araçları kullanıcılardan, geliştiricilerden, işletmelerden, siber savunuculardan ve bunlara ihtiyaç duyan küresel ortaklardan uzak tuttuğunu' kamuoyuna açıkladı A.
OpenAI, 'mümkün olan en kısa sürede kullanılabilirliği genişletmeyi planladığını' ancak genel kullanıma açılma tarihi açıklamadığını belirtiyor H. Sam Altman, 'birkaç hafta içinde' daha geniş erişim beklediğini ifade etti A. Şirketin sistem kartında ise şu ifade yer alıyor: 'Geniş erişime inanıyoruz ve GPT-5.6 Sol, Terra ve Luna'yı önümüzdeki haftalarda genel kullanıma sunmayı planlıyoruz' D.
Şimdilik, OpenAI'ın şimdiye kadar piyasaya sürdüğü en güçlü yapay zeka modeli, yalnızca Washington'un onayladığı kuruluşların kullanımına açık.