ENISA, Anthropic’in Mythos 5 modelini ve OpenAI’nin GPT 6 Astra modelini test edebiliyor; buna karşılık Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü’nün Mythos 5.1’e 1 Eylül’deki yayımlanmasından önce erişemediği b... AB Yapay Zekâ Tüzüğü, sistemik risk taşıyan genel amaçlı yapay zekâ modeli sağlayıcılarına değer...
YayımlayanGPT-5.6 Terra ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What does the EU’s access to Anthropic’s Mythos 5 and OpenAI’s GPT-6-Astra for ENISA testing reveal about the UK’s exclusion from pre-releas. Article summary: The episode exposes a practical weakness in the UK’s frontier-AI regime: an internationally respected evaluator cannot guarantee timely access when testing depends on a developer’s consent. The EU’s ENISA access is signi. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Birleşik Krallık’ın Anthropic’in Claude Mythos 5.1 modelini piyasaya çıkmadan önce test edemediğine ilişkin haberler, İngiliz teknik uzmanlığından çok erişim sorununa işaret ediyor. Bir ulusal değerlendirme kurumu, en gelişmiş modeli zamanında ve bağımsız biçimde inceleyemezse; güvenlik denetimi sonuçta model geliştiricisinin onayına bağlı kalır.
AB’nin siber güvenlik ajansı ENISA’nın Anthropic’in Mythos 5 ve OpenAI’nin GPT-6 Astra modellerine erişim kazanması önemli bir gelişme. Ancak bu, AB’nin her yeni sürümü otomatik olarak test edebileceği ya da Mythos 5.1’e eriştiği anlamına gelmiyor. 9
20
Avrupa Komisyonu sözcüsüne göre ENISA, Mythos 5’e erişim sağladı ve modeli test ediyor; ajansın GPT-6 Astra’ya da erişimi bulunuyor. 9 Ayrı haberlerde ise Anthropic’in, Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü’ne (AISI) Mythos 5.1’i piyasaya sürülmeden önce test için vermediği belirtildi. Bunun, Anthropic’in önemli bir modeli kurumun ön yayın test sürecinden ilk kez uzak tutması olduğu bildiriliyor.
20
23
Bu tabloyu basitçe “AB kazandı, Birleşik Krallık kaybetti” diye okumak yanıltıcı olur. ENISA’nın erişimi, belirli anlaşmalar çerçevesindeki iki isimli modelle sınırlı: Mythos 5 ve GPT-6 Astra. Mythos 5.1 ise ayrı bir sürüm ve daha kısıtlı erişim koşullarına sahip.
Ortaya çıkan pratik sonuç şu: Yapay zekâ güvenlik değerlendirmeleri artık model sürümüne, yetenek düzeyine, kullanım amacına, ülkeye ve geliştiricinin ortak seçme ölçütlerine göre parçalı bir yapıya bürünüyor.
Anthropic’e göre Claude Fable 5.1 ile Claude Mythos 5.1, aynı temel modelin farklı güvenlik önlemleriyle sunulan iki versiyonu. Fable 5.1 genel kullanıma açıkken Mythos 5.1, siber güvenlik ve yaşam bilimleri çalışmalarına yönelik “güvenilir erişim” programları üzerinden veriliyor. 12
Bu nedenle mesele sıradan bir ürün testi değil. Hassas siber güvenlik veya bilimsel işler için tasarlanan bir sistem; kontrollü çalışma ortamları, kötüye kullanım izleme, kullanıcı doğrulama süreçleri ve ulusal güvenliğe ilişkin işlem kuralları gibi başlıkları gündeme getiriyor. Haberlerde Mythos 5.1 erişiminin başlangıçta denetlenmiş ABD kuruluşlarıyla sınırlı olduğu aktarıldı. 18
24
Mevcut kanıtlar, Anthropic’in Birleşik Krallık’ı ya da AISI’yi güvenilmez bulduğu için dışladığını göstermiyor. Kısıtlı programın yapısı, operasyonel güvenlik gerekçeleri ve ticari erişim kontrolü makul açıklamalar olabilir. Yine de sonuç önemli: Yerleşik iş birliği ve değerlendiricinin itibarı, yüksek sonuç doğurma potansiyeline sahip bir modele zamanında erişimi garanti etmedi.
AB, yalnızca gönüllü iş birliğine dayanan sistemlere kıyasla daha güçlü bir hukuki zemine sahip. AB Yapay Zekâ Tüzüğü’nün 55. maddesi uyarınca, sistemik risk taşıyan genel amaçlı yapay zekâ modeli sağlayıcıları standartlaştırılmış protokol ve araçlarla model değerlendirmesi yapmak, sistemik riskleri değerlendirmek ve azaltmak, ciddi olayları izleyip bildirmek ve yeterli siber güvenlik koruması sağlamakla yükümlü. 43
37
Tüzük ayrıca modellerin piyasaya ilk kez sunulmasından önce değerlendirme yapılmasını; buna uygun durumlarda kurum içi veya bağımsız dış testlerle gerçekleştirilen ve belgelendirilen karşıt testleri de öngörüyor. 35
34
Ancak bu yükümlülükler, ENISA’nın model ağırlıklarına, sınırsız sistem erişimine veya her sınır model sürümüne piyasaya çıkmadan önce erişim için genel bir hakkı olduğu anlamına gelmiyor. ENISA’nın test düzenlemesi, AB’nin düzenleyici konumunun yanı sıra şirketlerle yürütülen iş birliği sayesinde elde edilmiş görünüyor. 4
9
Başka bir deyişle düzenleme, AB’nin kanıt, risk yönetimi ve uyum talep etme kapasitesini güçlendirebilir. Fakat hassas siber, biyolojik veya otonom ajan yeteneklerine sahip modellerin testinde güvenli iş birliği ihtiyacını ortadan kaldırmaz.
Mythos 5.1 vakası, gönüllü erişim modelinin sınırlarını açık biçimde gösteriyor. Olayın ardından AISI için daha güçlü yetkiler ve yasal statü çağrıları yapıldığı bildirildi. 23
Gönüllü yaklaşım, laboratuvarların iş birliğinde değer gördüğü durumlarda hızlı ve teknik bakımdan esnek olabilir. Ancak öngörülebilirlik bakımından zayıftır: Geliştirici erişimi kısıtlayabilir, uygun ortak grubunu değiştirebilir veya modeli daha dar bir ulusal güvenlik kanalı içinde tutmayı seçebilir.
Bu, Birleşik Krallık için stratejik bir risk yaratıyor. Değerlendiriciler en gelişmiş sistemlere ancak piyasaya çıktıktan sonra veya başka hükümetler ile onaylı ortaklar test ettikten sonra erişebiliyorsa, ülke güvenlik kanıtını şekillendiren taraftan başkalarının ürettiği kanıta dayanan tarafa kayabilir.
Kısa vadeli hedefin mutlaka model ağırlıklarının zorunlu devri olması gerekmiyor. Son derece yetenekli modellerde böyle bir yaklaşım, kendi başına güvenlik ve fikrî mülkiyet riskleri doğurabilir. Bunun yerine daha güçlü bir çerçeve, denetlenebilir ve kontrollü erişime odaklanabilir.
Olası adımlar şunlar olabilir:
Bu önerilerin ortak noktası, vakada açığa çıkan temel zaafı gidermek: Erişim, tek tek laboratuvarlarla ilişkilere tamamen bırakılmak yerine yönetişim sisteminin içine yerleştirilmeli.
Gidişat, katmanlı bir değerlendirme sistemine işaret ediyor. Geniş pazara sunulan modeller; sağlayıcı testleri, düzenleyici belgeler ve olay bildirim yükümlülüklerine tabi olacak. Daha hassas siber, biyolojik ve otonom ajan yetenekleri ise giderek daha kısıtlı ortamlarda değerlendirilecek. En yüksek riskli sistemlere yalnızca güvenlik soruşturmasından geçmiş sınırlı sayıdaki kamu kurumu, laboratuvar ve güvenlik ortağı erişebilecek.
ENISA’nın erişim düzenlemesi ile Birleşik Krallık’ın Mythos 5.1’den dışarıda kalması, bu ayrımın neden kritik olduğunu gösteriyor. Rekabet artık sadece en güçlü modeli kimin geliştireceğiyle ilgili değil; en etkili sürümleri geniş kullanıma açılmadan önce kimin inceleyebileceği, test edebileceği ve yönetebileceğiyle de ilgili. 9
12
20
Birleşik Krallık için teknik değerlendirme kapasitesi hâlâ çok değerli. Ancak tek başına yeterli değil. Etkisini koruması, içeride güvenilir yasal yetkilere; dışarıda ise ortaklarla kurulmuş, güvenlik hassasiyetini gözeten kalıcı erişim düzenlemelerine bağlı olacak.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
ENISA, Anthropic’in Mythos 5 modelini ve OpenAI’nin GPT 6 Astra modelini test edebiliyor; buna karşılık Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü’nün Mythos 5.1’e 1 Eylül’deki yayımlanmasından önce erişemediği b...
ENISA, Anthropic’in Mythos 5 modelini ve OpenAI’nin GPT 6 Astra modelini test edebiliyor; buna karşılık Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü’nün Mythos 5.1’e 1 Eylül’deki yayımlanmasından önce erişemediği b... AB Yapay Zekâ Tüzüğü, sistemik risk taşıyan genel amaçlı yapay zekâ modeli sağlayıcılarına değerlendirme, karşıt test, risk azaltma, ciddi olay bildirimi ve siber güvenlik yükümlülükleri getiriyor; fakat ENISA’ya her...
Olay, Birleşik Krallık’ta yasal bilgi ve değerlendirme yetkileri, güvenli test erişimi ve AB ile daha kurumsal iş birliği çağrılarını güçlendiriyor.