Siber güvenlik uzmanları, Anthropic'in yeni modeli Claude Fable 5'in masum güvenlik sorgularını bile agresif bir şekilde engellediğini ve kullanıcıya haber vermeden daha eski bir modele sessizce geçiş yaptığını belirt... Tepkilerin odağında, siber güvenlik, biyoloji, kimya ve yapay zeka 'damıtma' (distillation) tale...

Create a landscape editorial hero image for this Studio Global article: What is causing cybersecurity professionals to criticize Anthropic's Claude Fable 5, and how does the model's safety guardrail system work,. Article summary: Anthropic released Claude Fable 5 on June 9, 2026 as a guardrailed public version of its powerful Mythos-class model, alongside an unrestricted twin, Claude Mythos 5, available only to vetted partners through Project Gla. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Claude Fable 5: Why Anthropic Put Its Most Powerful AI Behind Guardrails. * Anthropic released Claude Fable 5 on 9 June 2026. It is the first publicly available Mythos-class mode" source context "Claude Fable 5: Anthropic Locks Down Cyber and Bio" Reference image 2: visual subject "# Anthropic says these topics
Anthropic, 9 Haziran 2026'da halka sunduğu en güçlü yapay zeka modeli olan Claude Fable 5'i piyasaya sürdü, ancak bu lansman siber güvenlik camiasından hızla yükselen bir tepkiyle karşılandı . Şirket bu modeli, en üst düzey teknolojisi olan Mythos sınıfının sorumlu bir sürümü olarak çerçevelerken, güvenlik profesyonelleri yerleşik güvenlik bariyerlerinin o kadar agresif olduğunu ve modeli meşru araştırma ve savunma çalışmaları için işlevsel olarak kullanışsız hale getirdiğini savunuyor.
Eleştirinin özü, güvenlik özelliklerinin var olması değil, nasıl uygulandıkları: sessizce, geniş kapsamlı bir şekilde ve kullanıcının haberi olmadan daha az yetenekli bir yapay zekayı devreye sokan bir yedekleme mekanizmasıyla. İşte tartışmanın ve arkasındaki teknolojinin bir dökümü.
Araştırmacıların en büyük şikayeti, Fable 5'in içerik sınıflandırıcılarının aşırı hassasiyeti. IBM X-Force'ta önde gelen bir güvenlik araştırmacısı olan Valentina “Chompie” Palmiotti, TechCrunch'a verdiği demeçte modelin “siber güvenlikle uzaktan yakından alakalı olabilecek her türlü talebi – bir blog yazısını okumak gibi masum görevleri bile – reddettiğini” söyledi . Bu, yalnızca tehlikeli sorguların değil, temel siber güvenlik kavramlarını anlamaya yönelik yardım taleplerinin dahi işaretlendiği anlamına geliyor.
Bu aşırı işaretlemenin, modelin kullanışlılığı üzerinde doğrudan ve olumsuz bir etkisi var. Bir sorgu işaretlendiğinde, kullanıcıya daha eski bir yapay zekadan gelen, sulandırılmış bir yanıt veriliyor ve kullanıcı bu geçiş hakkında açıkça bilgilendirilmiyor . Durumu daha da kötüleştiren şey, bu bilginin nasıl ifşa edildiği. Eleştirmenler, bu davranışın yalnızca 319 sayfalık bir sistem kartının derinliklerinde ortaya çıktığını ve bu durumun Anthropic'in belirli kullanıcılar için modelin yeteneklerini 'gizlice sabote ettiği' suçlamalarına yol açtığını iddia ediyor
.
Kısıtlamalar yalnızca siber güvenlikle sınırlı değil. Bariyerler ayrıca biyoloji, kimya ve daha da önemlisi yapay zeka model 'damıtma' (bir modelin çıktılarını başka bir modeli eğitmek için kullanma süreci) ile ilgili sorguları da hedef alıyor. Bu son nokta, bazı geliştiricilerin Anthropic'i, diğer yapay zeka geliştiricilerinin Fable 5'in çıktılarını eğitim için kullanmasını engelleyerek "güvenliği" rekabete aykırı davranış için bir bahane olarak kullanmakla suçladığı ayrı bir eleştiri dalgasını körükledi .
Anthropic'in Fable 5'teki güvenlik sistemi basit bir reddetme mekanizması değil. Bu, sessizce başarısız olmak üzere tasarlanmış bir yönlendirme sistemi . Mimari üç adımda çalışıyor:
Anthropic, bu sınıflandırıcıların ortalama olarak tüm oturumların %5'inden azında tetiklendiğini belirtiyor . Şirket, aşırı işaretleme sorununu kamuoyu önünde kabul etti. Bir şirket sözcüsü Business Insider'a verdiği demeçte, güvenlik önlemlerinin "güvenli, tarafsız veya masum talepleri işaretleyebileceğini" söyledi, ancak bunu, bu kadar güçlü temel yeteneklere sahip bir modeli halka açmanın gerekli bir bedeli olarak gerekçelendirdi
.
Anthropic'in tutumu, bu muhafazakar bariyerlerin bir hata değil, kasıtlı ve sorumlu bir seçim olduğu yönünde. Şirket, temeldeki Mythos sınıfı modelin, yazılım açıklarını bulma ve bunlardan yararlanma gibi görevlerde o kadar yetkin olduğunu ve kısıtlanmamış bir halka açık sürümün, felaketle sonuçlanabilecek bir kötüye kullanım riski yaratacağını savunuyor .
Onlara göre bariyerler, bir tasarım uzlaşmasıdır – halka en gelişmiş muhakeme, kodlama ve yazma modeline erişim sağlarken, modelin en tehlikeli potansiyel yeteneklerinin etrafına bir güvenlik duvarı örmenin bir yolu . Aşırı işaretlemeyi, güçlü bir modeli "hem güvenli hem de hızlı bir şekilde" piyasaya sürmenin geçici bir maliyeti olarak çerçeveliyor ve zaman içinde sınıflandırıcıları iyileştirme taahhüdünde bulunuyorlar
.
Claude Fable 5'in piyasaya sürülmesi tek başına tam olarak anlaşılamaz. Bu, en yeni yapay zeka modelleri için yeni bir endüstri standardı haline gelen iki kademeli bir dağıtım stratejisinin bir yarısıdır .
Fable 5'in piyasaya sürüldüğü gün, Anthropic Claude Mythos 5'i de duyurdu. Her iki model de tamamen aynı temel mimariyi ve ağırlıkları paylaşır – aynı "beyin"dirler. Tek fark, güvenlik yapılandırmasıdır. Mythos 5'in hassas alanlardaki sınıflandırıcıları kaldırılmıştır ve bu da ona tam, kısıtlanmamış yeteneklerini kazandırır .
Ancak, Mythos 5 halka açık değildir. Project Glasswing (Kristal Kanat Projesi) adlı bir girişim aracılığıyla, devlet kurumları ve kritik altyapı operatörleri de dahil olmak üzere küçük ve onaylı bir ortak grubuyla sınırlıdır . ABD hükümeti destekli bu program, başlangıçta AWS, Google ve Microsoft gibi teknoloji devlerinin de aralarında bulunduğu 12 kurucu ortakla, "siber savunmacıların" yazılım açıklarını büyük ölçekte bulup yamamak için yapay zekayı kullanmalarını sağlamak üzere başlatılmıştı
. Mythos 5'in piyasaya sürülmesiyle erişim yaklaşık 40 kuruluşa genişletildi
.
Aşağıdaki tablo, bu temel ayrımı göstermektedir:
Anthropic'in Fable/Mythos ayrımı, "yetkinlik kademeli yapay zeka dağıtımı" olarak adlandırılabilecek durumun en açık örneğidir. Bu yeni modelde, en yeni bir yapay zeka, tek bir ürün değildir. Tam gücü bir hak değil, bir ayrıcalıktır ve güvenlik bariyerleri ürün farklılaştırmasını yaratan mekanizmadır .
Bu durum Anthropic'e özgü değil. OpenAI dahil diğer önde gelen yapay zeka şirketleri de en gelişmiş modellerinin kısıtlı erişimli sürümlerini ulusal güvenlik ve araştırma ortaklarına sağlayarak benzer yaklaşımlar benimsemiştir . Fable/Mythos lansmanı, en güçlü yapay zeka yeteneklerinin teknolojiyle değil, bir onay statüsüyle sınırlandırıldığı bir geleceği kristalize ediyor; bu yaklaşımda güvenlik protokolleri erişim kontrol mekanizmaları işlevi görüyor ve bu durum şimdiden merkezileşme, adalet ve "halka açık" yapay zeka güvenliğinin gerçek anlamı hakkında daha geniş bir tartışmayı alevlendiriyor.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Siber güvenlik uzmanları, Anthropic'in yeni modeli Claude Fable 5'in masum güvenlik sorgularını bile agresif bir şekilde engellediğini ve kullanıcıya haber vermeden daha eski bir modele sessizce geçiş yaptığını belirt...
Siber güvenlik uzmanları, Anthropic'in yeni modeli Claude Fable 5'in masum güvenlik sorgularını bile agresif bir şekilde engellediğini ve kullanıcıya haber vermeden daha eski bir modele sessizce geçiş yaptığını belirt... Tepkilerin odağında, siber güvenlik, biyoloji, kimya ve yapay zeka 'damıtma' (distillation) taleplerini Claude Opus 4.8'e yönlendiren ve varlığı 319 sayfalık bir sistem kartının derinliklerinde saklanan bir mekanizma...
Kısıtlanmış halka açık model Fable 5 ile sınırsız, yalnızca onaylı kurumlara açık Mythos 5'in aynı anda piyasaya sürülmesi, 'yetkinlik kademeli yapay zeka' dağıtımında yeni bir endüstri standardına işaret ediyor ve şe...