Anthropic 的 Claude Fable 5 于2026年6月9日发布,三天后因亚马逊等公司研究人员的越狱事件,被美国商务部以国家安全为由下达出口管制令,全球范围内禁用。 经过18天的博弈,模型于6月30日解禁、7月1日恢复服务。Anthropic 部署了针对性的安全分类器,声称对越狱技术的拦截率超过99%。
研究答案

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What were the key developments surrounding Anthropic's Claude Fable 5 model, including the U.S. C. Article summary: Here is a fact-checked breakdown of the key developments around Anthropic's Claude Fable 5 model across all four areas you asked about.. Topic tags: general, academic, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts.
2026年6月,Anthropic 公司最强大的AI模型经历了上线、被封禁、再到恢复的戏剧性转折——整个过程仅18天。以下是经事实核查的事件时间线、原因分析及其对前沿AI部署的深远影响。
2026年6月9日,Anthropic 正式公开发布了 Claude Fable 5(一个对高网络攻击能力进行了限制的版本),同时发布的还有其不受限制的“兄弟”模型 Claude Mythos 5CA。这两个模型是Anthropic迄今为止公开提供的最强大的AI系统。
仅仅三天后,6月12日夜间,美国商务部长 霍华德·卢特尼克(Howard Lutnick) 致信CEO 达里奥·阿莫迪(Dario Amodei),以国家安全风险为由,要求Anthropic立即停止对这两个模型的所有访问权限AADR。美国工业与安全局(BIS)依据《出口管制改革法案》(Export Control Reform Act)发出了一份“知悉函”(Is Informed letter),实际上禁止向全球任何地方的外国国民分发该模型,甚至包括 Anthropic 公司内部的非美国籍员工AAF。
由于Anthropic无法实时可靠地区分外国国民和美国国内用户,该公司于6月13日被迫 对全球所有客户 禁用了这两个模型DFL。
直接原因是 亚马逊(Amazon) 及其他几家公司研究人员报告的一次成功“越狱”(jailbreak)CKB。他们据称成功提取了可用于 offensive 网络安全操作的信息,美国政府认为这构成了国家安全威胁。根据Anthropic的内部审查,触发此次出口管制令的提示词(prompt)实际上是一个 标准的代码库安全审计请求——Anthropic 辩称,这种能力在OpenAI的GPT-5.5和其他前沿模型中已经存在A。
出口管制于 2026年6月30日 被取消,结束了为期18天的禁令ACADR。Fable 5 于 7月1日 在 Claude.ai、Claude Platform API 以及企业版计划中恢复服务FAT。商务部的信函中 保留了如果Anthropic未能履行其安全承诺,可重新实施管制的权利A。
Fable 5 事件不仅仅带来了一个恢复上线的模型——它催生了一个全新的 行业通用AI越狱严重程度评分框架。Anthropic 宣布正在与 亚马逊、微软和谷歌(以及其他Project Glasswing合作伙伴)共同制定一个共享评分标准FAA。该框架的关键特征包括:
这个框架本身可能比模型本身更具影响力。正如一份分析所言:“Anthropic、亚马逊、微软和谷歌正在共同开发越狱严重程度标准,这在缺乏联邦AI监管的背景下,创造了一种 事实上的行业政策”A。
Fable 5 发布时采用了一种新的架构:安全分类器(safety classifiers)。这些分类器会标记某些高风险请求类别,并将被标记的查询路由到 Claude Opus 4.8(一个后备模型),而不是让Fable 5的完整能力直接响应VAA。被标记的类别包括:
在出口管制解除后,Anthropic 部署了一个 改进版安全分类器,专门针对触发最初禁令的越狱技术。Anthropic声称,该分类器能在 超过99%的情况下 阻止该越狱技术,被阻止的请求仍会被路由到 Opus 4.8FP。该公司承认,作为权衡,该分类器会误拦截一些良性的请求F。
API定价: Claude Fable 5 在 Anthropic API 上的定价为 每百万输入tokens 10美元,每百万输出tokens 50美元AADFP。官方 Claude 文档还列出了缓存输入 ($12.50/MTok) 、非缓存输入 ($20/MTok) 以及“书签输入” ($1/MTok) 的价格P。
免费试用期: 从发布日(6月9日)至 2026年6月22日,Fable 5 对 Claude Pro、Max、Team 以及基于座位的企业版计划用户免费开放CDFAA。
过渡到按量计费: 从 2026年6月23日 起,Fable 5 被从这些捆绑计划中移除。此后,任何 Fable 5 请求都将消耗 付费使用额度,按 API 每次token的费率(输入10美元/MTok,输出50美元/MTok)计费,不再由订阅计划中包含的免费额度覆盖CDFAA。
关于7月7日的说明: 一些第三方评论提到了7月7日作为后续定价调整的日期。但官方 Anthropic 文档和所有详细的第三方报告均确认,免费试用期的截止日期是 6月23日CDFA。在6月30日出口管制解除后,部分 Pro、Max 和 Team 计划的用户可能看到了一段临时的免费重新接入窗口(截至7月7日),之后才完全转为按量计费模式FAA。
Claude Fable 5 从发布、被禁到恢复的18天历程,不仅仅是一个模型的故事。它是一个关于前沿AI公司和政府如何——尽管过程尴尬且公开——在一个缺乏正式AI安全监管的世界里,协商部署强大模型的规则的典型案例。此次僵局中催生的越狱严重程度框架,可能会为行业应对下一次不可避免的越狱事件设定标准。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Anthropic 的 Claude Fable 5 于2026年6月9日发布,三天后因亚马逊等公司研究人员的越狱事件,被美国商务部以国家安全为由下达出口管制令,全球范围内禁用。
Anthropic 的 Claude Fable 5 于2026年6月9日发布,三天后因亚马逊等公司研究人员的越狱事件,被美国商务部以国家安全为由下达出口管制令,全球范围内禁用。 经过18天的博弈,模型于6月30日解禁、7月1日恢复服务。Anthropic 部署了针对性的安全分类器,声称对越狱技术的拦截率超过99%。
此次事件催生了Anthropic与亚马逊、微软、谷歌等公司共同开发的行业首个AI越狱严重程度评级框架,为未来缺乏联邦AI监管的环境提供了事实标准。