Evan Hubinger’ın yüzde 10’un üzerindeki tahmini kişisel görüşü; Anthropic’in resmî risk hesabı veya bilimsel bir uzlaşı değil. Asıl endişe, güncel modellerin yakın tehlikesinden ziyade, kendini geliştirebilen çok daha güçlü sistemler için kanıtlanmış bir kontrol yönteminin bulunmaması.
YayımlayanGPT-5.6 Terra ile düzenlendiGörseller GPT Image 2 ile oluşturuldu
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Anthropic alignment science lead Evan Hubinger’s public statement that he personally believes there is more than a 10% chance AI co. Article summary: Hubinger’s statement chiefly exposed a sharp mismatch between frontier-AI labs’ public safety posture and the private-level uncertainty described by people closest to the work: a senior alignment lead said the field may . Topic tags: general, general web, news, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Evan Hubinger’ın kamuya açık açıklaması, yapay zekânın insanlığın sonunu kesin olarak getireceğini göstermedi. Ancak çok daha dar ve önemli bir noktayı ortaya koydu: Anthropic’in hizalama bilimi lideri, önümüzdeki on yıl içinde böyle bir sonucun yaşanması ihtimalini kişisel olarak yüzde 10’un üzerinde gördüğünü; şirketin süper zekâyı insan hedefleriyle güvenilir biçimde uyumlu tutma sorununu çözmek için henüz bir plana sahip olmadığını ve çözüme giden yolun da netleşmediğini söyledi. 1
2
Bu iki beyan, eski Anthropic ve OpenAI araştırmacısı Jacob Coxon’ın istifasının arkasındaki kaygıya somut bir dayanak sağladı: Sınır modeller geliştiren laboratuvarlar, insan niyetiyle güvenilir biçimde uyumlu kalmasını sağlayacak yöntemleri henüz kanıtlanmamış sistemlere doğru ilerliyor olabilir. 2
3
Hubinger’ın “yüzde 10’dan fazla” ifadesi kendi risk değerlendirmesiydi. Bu oran Anthropic’in resmî olasılık hesabı, çalışanlar arasında ortak görüş ya da yerleşik bilimsel öngörü olarak sunulmadı. 1
2
Bu ayrım önemli. Tek başına bir olasılık tahmini, felaketin hangi mekanizma ile yaşanacağını açıklamaz, takvim belirlemez veya böyle bir sonucun muhtemel olduğunu kanıtlamaz. Hubinger’ın, hâlihazırda erişilebilen modellerden kaynaklanan riski düşük gördüğü bildirildi. Endişesi; gelecekte sistemlerin, özellikle yapay zekânın daha güçlü yapay zekâ üretmeye yardımcı olması anlamına gelen özyinelemeli kendini geliştirme yoluyla, çok daha yetenekli hâle gelmesi ihtimaliydi. 2
10
Buna rağmen sözleri dikkat çekici; çünkü büyük bir sınır yapay zekâ laboratuvarında hizalama çalışmalarını yöneten bir isimden geldi. Asıl mesele çarpıcı bir yüzde değil, yetenekler hızla ilerlerken süper zekâ sistemlerinin insan denetiminde tutulabileceğine dair güvenin düşük olmasıydı. 1
2
Hem OpenAI hem Anthropic’te çalışmış olan Coxon, iki şirketin de sorumlu davranmadığını ve kendini geliştirebilen süper zekâya doğru yarıştığını savunarak istifa etti. Hubinger, bu sistemleri geliştiren kişilerin insanlığın yok oluşu ölçeğindeki sonuçları gerçekten mümkün gördüğü yönündeki temel iddiaya kamuoyu önünde katıldı. 2
3
Bu durum, tüm çalışanların aynı kanaatte olduğunu göstermez; Coxon’ın iki şirkete dair anlatımını da bağımsız biçimde doğrulanmış bir değerlendirmeye dönüştürmez. Yine de istifayı, eski bir çalışanın tekil şikâyeti diye geçiştirmeyi zorlaştırır. Görevdeki bir hizalama lideri, ciddi kurum içi kaygıların sınır kapasite geliştirme faaliyetleriyle aynı anda var olabileceğini doğrulamış oldu. 1
2
Samuel Marks’ın bağlantılı açıklamaları da aynı temkinle okunmalı. Haberlere göre Marks, yapay zekâ geliştiricilerinin teknolojinin insanlığın yok olmasına veya benzer ölçüde ağır sonuçlara yol açabileceğine inandığını söyledi. Ancak bu, yayımlanmış şirket çapında bir risk tahmini değil, içeriden bir kişinin değerlendirmesidir. 5
Bu olay çoğu zaman “yapay zekâ felaketçileri ile iyimserler” karşıtlığına indirgeniyor. Daha yararlı soru ise şu: Olası zararlar küresel ve geri döndürülemez nitelikteyken, ihtimal ve zaman çizelgesi belirsizse hangi güvenceler zorunlu olmalı?
Hubinger’ın açıklaması birkaç başlığı keskinleştiriyor:
Bunlar yaklaşan bir felaketin kanıtı değil; yönetişim sorunlarıdır. Ancak tehlikeli yetenekler ortaya çıktıktan sonra çözülmesi daha zorlaşabilecek sorunlar da tam olarak bunlardır.
Haberlere göre Anthropic, en yeni modelini yayımlanmadan önce test edilmek üzere Birleşik Krallık Yapay Zekâ Güvenliği Enstitüsü’ne sunmayı kabul etmedi. Bu iddiaya ihtiyatla yaklaşmak gerekiyor: Mevcut anlatımlar bunu şirketin ya da Birleşik Krallık hükümetinin doğruladığı bir bulgu olarak değil, haber olarak aktarıyor. 10
Yine de bu iddia, gönüllü güvenlik taahhütlerine neden kuşkuyla bakıldığını gösteriyor. Bir şirketin güvenlik liderleri hizalamada çözülmemiş problemler bulunduğunu kabul ediyorsa, dış gözlemcilerin hangi testlerin yapıldığını, kimlerin incelediğini, hangi sonuçların paylaşıldığını ve hangi yetenek eşiklerinde daha sıkı kontrollerin devreye girdiğini sorması makul olur.
“Yavaşlama” çağrısı, tüm yapay zekâ araştırmalarının veya kullanımlarının kalıcı biçimde durdurulması demek olmak zorunda değil. Politika tartışmasının odağında, sistemler özellikle kritik yetenek eşiklerini aşmadan önce uygulanabilir ve denetlenebilir kontroller bulunması yer alıyor.
Olası araçlar şunlar olabilir:
Mantık basit: Risk belirsiz olsa da olası zarar çok büyükse, güvenlik tedbirleri kontrol kaybedildikten sonra değil, öncesinde gösterilebilir olmalıdır.
Hubinger’ın paylaşımı, sınır yapay zekânın merkezindeki gerilimi görünür kıldı: Önde gelen geliştiriciler, uzun vadede ağır riskler bulunduğunu açıkça kabul ederken bu riskleri daha acil hâle getirebilecek kapasitelere doğru geliştirmeyi sürdürebiliyor. 1
2
Bu açıklama, felaket düzeyinde yapay zekâ zararının olasılığını kesinleştirmiyor ve Anthropic’in resmî öngörüsü olarak da okunmamalı. Buna karşın hizalama tartışmasını soyutluktan çıkarıyor. Soru artık yalnızca gelişmiş yapay zekânın tehlikeli olup olamayacağı değil; şirketlerin ve hükümetlerin, bağımsız kanıtlar, uygulanabilir kurallar ve uluslararası koordinasyon yoluyla, söz konusu sistemler güvenle yönetilemeyecek kadar güçlü hâle gelmeden önce hazır olduklarını gösterip gösteremeyeceği. 1
10
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Evan Hubinger’ın yüzde 10’un üzerindeki tahmini kişisel görüşü; Anthropic’in resmî risk hesabı veya bilimsel bir uzlaşı değil.
Evan Hubinger’ın yüzde 10’un üzerindeki tahmini kişisel görüşü; Anthropic’in resmî risk hesabı veya bilimsel bir uzlaşı değil. Asıl endişe, güncel modellerin yakın tehlikesinden ziyade, kendini geliştirebilen çok daha güçlü sistemler için kanıtlanmış bir kontrol yönteminin bulunmaması.
Tartışma; bağımsız güvenlik testleri, şirketlerin şeffaflığı ve ülkeler arası bağlayıcı koordinasyon ihtiyacına odaklanıyor.