Anthropic, yabancı uyruklu kullanıcıları yerel kullanıcılardan gerçek zamanlı olarak güvenilir bir şekilde ayırt edemediği için, 13 Haziran'da her iki modeli de dünya çapındaki tüm müşterileri için devre dışı bıraktı DFL.
Yasağın acil nedeni, Amazon ve diğer birkaç şirketteki araştırmacıların bildirdiği bir jailbreak saldırısıydı. Bu saldırıyla, saldırgan siber güvenlik operasyonları için kullanılabilecek bilgilerin ele geçirildiği iddia ediliyordu. Hükümet bunu ulusal güvenlik meselesi olarak gördü CKB. Anthropic'in kendi iç incelemesine göre, ihracat kontrol emrini tetikleyen komut, standart bir kod tabanı güvenlik denetimi talebiydi — Anthropic'in halihazırda OpenAI'ın GPT-5.5 ve diğer sınır modellerinde bulunan bir yetenek olduğunu savunduğu bir talep A.
İhracat kontrolleri 30 Haziran 2026'da kaldırıldı ve 18 günlük askıya alma süreci sona erdi ACADR. Fable 5, 1 Temmuz'da Claude.ai, Claude Platform API'si ve kurumsal planlar üzerinden kullanıcılara geri verildi FAT. Ticaret Bakanlığı'nın mektubu, Anthropic'in güvenlik taahhütlerini yerine getirmemesi durumunda kontrolleri yeniden uygulama hakkını saklı tuttu A.
Fable 5 olayı sadece geri getirilen bir modelle sonuçlanmadı; aynı zamanda AI jailbreak'lerinin şiddetini derecelendirmek için yeni, sektör genelinde bir çerçevenin oluşturulmasını zorladı. Anthropic, Amazon, Microsoft ve Google (ve diğer Project Glasswing ortakları) ile birlikte ortak bir derecelendirme sistemi üzerinde çalıştığını duyurdu FAA. Çerçevenin temel özellikleri:
Bu çerçeve, modelin kendisinden daha önemli olabilir. Bir analizin belirttiği gibi: "Anthropic, Amazon, Microsoft ve Google, ortak jailbreak-şiddeti standartları geliştiriyor ve federal AI düzenlemelerinin yokluğunda fiili bir endüstri politikası oluşturuyor" A.
Fable 5, yeni bir mimariyle piyasaya sürüldü: belirli yüksek riskli istek kategorilerini işaretleyen ve işaretlenen sorguları Fable 5'in tam yetenekleriyle yanıtlamak yerine Claude Opus 4.8'e (bir yedek model) yönlendiren güvenlik sınıflandırıcıları VAA. İşaretlenen kategoriler şunları içeriyor:
İhracat kontrolleri kaldırıldıktan sonra Anthropic, orijinal emri tetikleyen jailbreak tekniğini hedef alan geliştirilmiş bir güvenlik sınıflandırıcısı kullanıma sundu. Şirket, bu sınıflandırıcının bildirilen tekniği vakaların %99'undan fazlasında engellediğini iddia ediyor. Engellenen istekler hala Opus 4.8'e yönlendiriliyor FP. Şirket, bu sınıflandırıcının bir takas olarak bazı masum istekleri de işaretleyebileceğini kabul etti F.
API fiyatlandırması: Claude Fable 5, Anthropic API'sinde milyon giriş token'ı başına $10 ve milyon çıkış token'ı başına $50 olarak fiyatlandırılmıştır AADFP. Resmi Claude belgeleri ayrıca önbelleğe alınmış giriş için $12.50/MTok, önbelleğe alınmamış giriş için $20/MTok ve "bookend giriş" için $1/MTok olarak listeliyor P.
Ücretsiz tanıtım dönemi: 9 Haziran'dan 22 Haziran 2026'ya kadar Fable 5, Claude Pro, Max, Team ve koltuk bazlı Kurumsal planlarda ek ücret ödemeden kullanılabiliyordu CDFAA.
Ölçülen faturalamaya geçiş: 23 Haziran 2026'da Fable 5, bu paket planlardan çıkarıldı. Bu tarihten sonra, herhangi bir Fable 5 isteği, planın dahil edilen kotası yerine API başına token oranları ($10/$50 MTok) üzerinden faturalandırılan ücretli kullanım kredilerini tüketiyor CDFAA.
7 Temmuz notu: Bazı üçüncü taraf yorumlarında 7 Temmuz tarihli bir fiyat ayarlamasından bahsediliyor. Ancak resmi Anthropic belgeleri ve ayrıntılı üçüncü taraf raporlarının tümü, ücretsiz dahil etme dönemi için 23 Haziran kesintisi konusunda hemfikirdir CDFA. İhracat kontrollerinin 30 Haziran'da kaldırılmasının ardından, Pro, Max ve Team planlarındaki bazı kullanıcılar, ölçülen kredilerin tam olarak devreye girmesinden önce 7 Temmuz'a kadar süren geçici bir yeniden dahil etme penceresi gördü FAA.
Claude Fable 5'in lansmandan yasağa ve geri dönüşe kadar geçen 18 günlük yolculuğu, sadece bir modelin hikayesi değil. Resmi bir AI güvenlik düzenlemesi olmayan bir dünyada, sınırda AI şirketlerinin ve hükümetlerin güçlü modelleri dağıtma kurallarını — gariptir ki halkın gözü önünde — nasıl müzakere ettiğinin bir örneğidir. Bu gerilimden doğan jailbreak şiddeti çerçevesi, sektörün bir sonraki kaçınılmaz güvenlik ihlaline nasıl tepki vereceğine dair standardı belirleyebilir.