OpenAI, 3 Eylül’de GPT 6 Astra’yı sınırlı sayıdaki kuruluşa açarak tanıttı; modeli en yetenekli ve en uyumlu modeli olarak nitelendirdi. Şirket; FrontierMath Tier 4’te %98, ARC AGI 3’te %99,9 ve ExploitBench’te %100 sonuç bildirdi.
YayımlayanGPT-5.6 Terra ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI’nin 3 Eylül tarihli duyurusu, GPT-6 Astra’yı kodlama, araştırma, bilgisayar kullanımı ve profesyonel iş akışlarındaki zor, çok adımlı görevler için konumlandırıyor. Şirket, modeli şimdiye kadarki en zeki ve en uyumlu modeli olarak tanımlıyor; ancak genel kullanıma hemen açmak yerine önce sınırlı sayıdaki kuruluşa sunuyor. 2
5
13
Duyuruyu önemli kılan yalnızca açıklanan test skorları değil. OpenAI’ye göre Astra, şirketin Hazırlıklılık Çerçevesi kapsamında Critical (Kritik) siber güvenlik yeteneği eşiğine ulaşan ilk model. Bu nedenle performans iddiaları ile kademeli erişim ve güvenlik yaklaşımını birlikte değerlendirmek gerekiyor. 10
12
OpenAI, Astra’nın bilgisayar kullanımı, web’de gezinme, yazılım mühendisliği, siber güvenlik, bilim ve profesyonel işlerde en ileri düzeyde olduğunu belirtiyor. Geliştirici dokümantasyonu da modeli; karmaşık akıl yürütme, kodlama, bilgisayar kullanımı, araştırma ve belge üretimi için tasarlanmış olarak tanımlıyor. 1
3
13
Şirketin öne çıkardığı üç sonuç şöyle:
Bunlar OpenAI’nin yayımladığı değerlendirme sonuçlarıdır; bağımsız biçimde tekrarlanmış ölçümler değildir. Yüksek benchmark skorları, test edilen görevlerde ilerlemeye işaret edebilir. Ancak tek başına genel zekâyı, gerçek hayatta güvenilir muhakemeyi ya da her ortamda güvenli otonom davranışı kanıtlamaz.
OpenAI, Astra’nın kendi Hazırlıklılık Çerçevesi’nde siber güvenlik açısından Critical seviyesine ulaşan ilk model olduğunu söylüyor. Şirketin tanımına göre bu; uygun araçlara ve erişime sahip olduğunda modelin, bir insanın her adımı yönlendirmesine gerek kalmadan iyi korunan çok sayıda sistemde daha önce bilinmeyen açıkları bulabilmesi ve bunları istismar etmeye yönelik yeni yöntemler geliştirebilmesi anlamına geliyor. 10
12
Bu iddianın iki açık sınırı var:
OpenAI, zararlı siber eylemlere karşı ek korumalar uyguladığını ve Astra’nın kullanıma sunulması sırasında ilave izleme yaptığını belirtiyor. 5
10 Modelin geniş kitlelere anında açılmaması da şirketin tanımladığı ek riskle uyumlu bir yaklaşım.
OpenAI, Astra’nın şimdiye kadarki en uyumlu modeli olduğunu; görev sınırlarına uyma ve şeffaf iletişim konusunda daha iyi performans verdiğini ifade ediyor. 2
13
Bu ifade dikkatle yorumlanmalı. Bir model duyurusunda “uyumlu” denmesi, belirli eğitim yöntemleri ve testler altında alınan performansı anlatır. Bir ajanın kullanıcının niyetini her zaman doğru çıkaracağı, her operasyonel sınırda kalacağı veya insan denetimi olmadan güvenle dağıtıma alınabileceği anlamına gelmez. OpenAI’nin sürüm notlarında da, ajanların talimatları yanlış yorumlamış olabileceği durumları saptamak için ek izleme bulunduğu yazıyor. 5
Ajan tabanlı kullanım düşünen kurumlar için pratik soru, modelin hangi etiketle tanıtıldığı değil; hangi izinlere sahip olduğu, hangi işlemlerin onay gerektirdiği, etkinliklerin nasıl kayda alındığı ve beklenmedik davranışta sistemin ne kadar hızlı durdurulabildiğidir.
Sağlanan materyal, bazı değerlendirme sonuçlarıyla ilgili sonradan yapılan nitelemelere işaret ediyor. Bunlar arasında benchmark’a önceden maruz kalma riski ve özel erişim yapılandırmalarıyla varsayılan üretim erişimi arasındaki farklara dair kaygılar bulunuyor. Materyalde ayrıca, yalnızca zincirleme düşünce (chain-of-thought) izlemeye dayalı testlerin, daha geniş bağlam sunan izlemeye göre daha etkisiz kaldığı durumlar da anlatılıyor.
Bununla birlikte, sağlanan birincil kaynak alıntıları bütün sonuçların eksiksiz ve bağımsız biçimde denetlenebilir bir revizyon geçmişini ya da izleme yönteminin tüm ayrıntılarını sunmuyor. Bu nedenle makul sonuç sınırlı: Başlık niteliğindeki benchmark sayıları ve güvenlik değerlendirmeleri, sürümle birlikte değişebilen kanıtlar olarak görülmeli; belirli bir skor veya dağıtım iddiasına dayanılmadan önce güncel model dokümantasyonu ile güvenlik materyalleri kontrol edilmeli. 2
3
10
Lansman, OpenAI modellerini içeren daha önceki bir güvenlik testi olayının ardından geldi. OpenAI, bu olayın Astra’ya yönelik güvenlik yaklaşımına katkı sağladığını; Astra’nın ise olayda yer alan model olmadığını belirtiyor. 10
Bu bağlam önemli, çünkü otonom sistemler model kapasitesini tarayıcılar, kod araçları ve diğer yazılımlar üzerinden eyleme geçme imkânıyla birleştiriyor. Bir modelin sistemler arasında işlem yapabilmesi onu faydalı kılar; aynı özellik sınırlandırma, en az ayrıcalık ilkesi ve izlemeyi de daha kritik hâle getirir.
OpenAI, Astra’yı ilk aşamada sınırlı bir kuruluş grubuna açtığını, daha geniş erişimin ise sonradan planlandığını açıkladı. 5
13
Geliştiriciler için GPT-6 Astra’nın API fiyatı, milyon giriş tokenı başına 10 ABD doları ve milyon çıkış tokenı başına 50 ABD doları olarak listeleniyor. Model sayfasında ayrıca 1,05 milyon token bağlam penceresi ve en fazla 128.000 çıkış tokenı bilgisi yer alıyor. 3
ChatGPT tarafında erişim ayrı katmanlarda ve kademeli olarak veriliyor. OpenAI’nin yardım dokümanına göre Astra tarafından desteklenen GPT-6 Pro; Pro 100 ABD doları, Pro 200 ABD doları, Business ve Enterprise planlarında kullanıma açılıyor. Plus planlarına ise dağıtım ilerledikçe ChatGPT Work ve Codex içinde Astra sunuluyor. Erişim, ChatGPT ürünleri ve çalışma alanı ayarlarına göre farklılık gösterebilir. 6
GPT-6 Astra duyurusu birbirinden koparılmaması gereken iki mesaj taşıyor: OpenAI, karmaşık ve araç kullanan işlerde büyük bir yetenek sıçraması iddia ediyor; aynı zamanda modelin siber yeteneğini kendi en yüksek risk katmanına yerleştiriyor. 10
13
Lansman benchmark’ları, OpenAI’nin Astra’nın kendi testlerinde neler yapabildiğini söylediğine dair kanıt niteliğinde. Kademeli erişim, ek izleme ve siber kısıtlamalar ise şirketin bu yetenekleri sıradan görmediğini gösteriyor. Modeli değerlendiren ekipler için öncelik, benchmark başarısının otomatik olarak güvenilir otonomiye dönüşeceğini varsaymak değil; dar kapsamlı araçlar, sonuç doğuran işlemlerde açık onay adımları, izole ortamlar ve incelenebilir kayıtlarla kontrollü dağıtım yapmak olmalı.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
OpenAI, 3 Eylül’de GPT 6 Astra’yı sınırlı sayıdaki kuruluşa açarak tanıttı; modeli en yetenekli ve en uyumlu modeli olarak nitelendirdi.
OpenAI, 3 Eylül’de GPT 6 Astra’yı sınırlı sayıdaki kuruluşa açarak tanıttı; modeli en yetenekli ve en uyumlu modeli olarak nitelendirdi. Şirket; FrontierMath Tier 4’te %98, ARC AGI 3’te %99,9 ve ExploitBench’te %100 sonuç bildirdi.
Astra, OpenAI’nin Hazırlıklılık Çerçevesi’nde ilk kez “Critical” siber yetenek eşiğine ulaşan model oldu.