直接原因係 Amazon嘅研究員 同其他幾間公司聲稱成功jailbreak咗個模型,提取到有用於進行攻擊性網絡安全操作嘅資訊——政府認為呢個係國家安全問題 CKB。根據Anthropic內部審查,觸發出口管制指令嘅提示係一個 標準嘅代碼庫安全審計請求——Anthropic認為呢種能力已經存在於OpenAI嘅GPT-5.5同其他前沿模型中 A。
出口管制喺 2026年6月30日 解除,結束咗為期18日嘅暫停 ACADR。Fable 5喺 7月1日 恢復服務,適用於Claude.ai、Claude Platform API同企業計劃 FAT。不過,商務部嘅信件 保留咗權利,如果Anthropic嘅安全承諾未有兌現,可以重新實施管制 A。
Fable 5事件唔單止帶返個模型,仲催生咗一個全新嘅 業界通用AI jailbreak嚴重程度評分框架。Anthropic宣布正同 Amazon、Microsoft、Google(以及其他Project Glasswing合作夥伴)合作制定一個共享嘅評分標準 FAA。主要特點:
呢個框架嘅影響力可能比模型本身更大。正如有分析指出:「Anthropic、Amazon、Microsoft同Google正在開發共享嘅jailbreak嚴重程度標準,喺聯邦AI法規缺位嘅情況下,創造咗一個 實質上嘅行業政策」A。
Fable 5推出時配備咗一個新架構:安全分類器 會標記某啲高風險請求類別,並將被標記嘅查詢導向 Claude Opus 4.8(一個備用模型),而唔係讓Fable 5嘅完整能力直接回應 VAA。被標記嘅類別包括:
出口管制解除之後,Anthropic部署咗一個 改良咗嘅安全分類器,專門針對觸發禁令嘅jailbreak技術,聲稱可以喺 超過99%嘅案例中 阻止相關技術,被阻止嘅請求仍然會導向Opus 4.8 FP。公司承認呢個分類器會誤標部分良性請求,呢個係取捨 F。
API定價: Claude Fable 5喺Anthropic API上嘅價格為 每百萬輸入tokens 10美元,每百萬輸出tokens 50美元 AADFP。官方Claude文檔仲列出咗$12.50/MTok(緩存輸入)、$20/MTok(非緩存輸入)同$1/MTok(「bookend input」)P。
轉為按用量收費: 喺 2026年6月23日,Fable 5從呢啲捆綁計劃中移除。之後,任何Fable 5請求都會消耗 付費用量額度(usage credits),按API嘅每token費率($10/$50每MTok)收費,而唔再係由計劃嘅包月配額包含 CDFAA。
7月7日嘅特殊情況: 一部分第三方報導提到7月7日係後續價格調整嘅日期。但係,官方Anthropic文檔同所有詳細第三方報告都一致指出免費包含期嘅截止日期係 6月23日 CDFA。出口管制喺6月30日解除後,部分Pro、Max同Team計劃嘅用戶經歷咗一個短暫嘅重新包含窗口,直至7月7日,之後用量額度先全面生效 FAA。
Claude Fable 5由推出、被禁到解禁嘅18日旅程,唔單止係一個模型嘅故事。佢係一個案例研究,展示咗前沿AI公司同政府如何——雖然尷尬又公開地——協商喺欠缺正式AI安全法規嘅世界中部署強大模型嘅規則。由呢場對峙中誕生嘅jailbreak嚴重程度框架,可能會為業界應對下一次無可避免嘅繞過事件設定標準。