Anthropic 公開釋出旗下最強 AI「Claude Fable 5」,這是一款「神話級」(Mythos class)模型,內建了全新的安全分類器,會將被標記為高風險的請求,悄悄地轉交給能力較弱的 Claude Opus 4.8 處理,而非直接拒絕。 同步推出的還有 Claude Mythos 5,它是與 Fable 5 技術基礎完全相同但移除了部分安全限制的版本,目前僅嚴格提供給參與美國政府「玻璃翼計畫」(Project Glasswing)的資安合作夥伴使用。

Create a landscape editorial hero image for this Studio Global article: What are the key details about the June 9, 2026 launch of Anthropic's Claude Fable 5 (a Mythos-class model made safe for general use with ne. Article summary: Here is a comprehensive breakdown of the June 9, 2026 launch of Claude Fable 5 and Claude Mythos 5, based on Anthropic's official announcements, API documentation, and major news reports.. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "Anthropic: AI safety company developing Claude language models. Founded by ex-OpenAI members, focusing on safe AI systems." source context "Claude Fable 5: Anthropic releases a 'safe' version of Claude Mythos" Reference image 2: visual subject "Anthropic: AI safety company developing Claude language models. Founded by ex-OpenAI members, focusing
為了將最強大的 AI 技術安全地推向大眾,Anthropic 採取了一項業界罕見的雙軌策略。這不僅僅是一次模型更新,更像是一場精心策劃的社會實驗。
2026 年 6 月 9 日,Anthropic 正式發布了其首款可供公眾使用的「神話級」(Mythos-class)人工智慧模型——Claude Fable 5。這個所謂的「神話級」,是該公司定義中超越過往「Opus」系列的全新能力門檻。然而,這個強大的模型在交到一般使用者手中時,卻被裝上了一副前所未見的「安全手銬」。
這次發布真正的關鍵,在於 Anthropic 實際上釋出了同一底層技術下的兩種不同面貌。Anthropic 表示,Claude Fable 5 與 Claude Mythos 5 擁有相同的基礎模型與權重。
公開版:Claude Fable 5
限制版:Claude Mythos 5
兩款模型皆支援高達 100 萬 tokens 的上下文窗口,並可生成最多 12.8 萬 tokens 的輸出內容。
過去,多數 AI 模型在面對危險提問時(例如如何製造蓖麻毒素),會直接拒絕回答。但 Fable 5 的機制更為微妙且複雜。
它使用的是一套外部的 AI 監控系統(即分類器),這些系統會即時監控使用者是否試圖進行濫用或越獄攻擊(Jailbreak)。一旦使用者觸發了分類器,Fable 5 不會拒絕回應,而是會「默默地」將該次請求轉交給 Anthropic 較舊、能力較弱的模型——Claude Opus 4.8,並向用戶顯示相關提示。
這套降級機制主要活躍於三大高風險主題:
Anthropic 坦承這套系統的判定偏向保守,有時會誤攔一些無害的請求,但強調平均而言,觸發安全機制的情況僅發生在不到 5% 的使用會話中。為了確保穩固性,該系統經過了廣泛的內部紅隊測試,以及外部漏洞賞金計畫(Bug Bounty);據稱在超過一千小時的外部測試中,沒有人能找到通用的越獄方法
。
Anthropic 為 Fable 5 制定了一個極具行銷手法的上市計畫,鼓勵用戶盡快試用。
值得注意的是,即便在收費後,若用戶的提問觸發了安全分類器,且在被轉交給 Opus 4.8 處理並生成任何輸出之前就被攔截,Anthropic 將不會向用戶收取該次提示的費用。
根據 Anthropic 的內部基準測試,Fable 5 在「幾乎所有經過測試的 AI 能力基準」上都達到業界頂尖水準。在實際應用中,合作夥伴的回饋也相當驚人:
伴隨這次強大技術釋出的,還有嚴格的資料政策變更。Claude Fable 5 與 Mythos 5 都被列為「涵蓋模型」(Covered Models),這意味著用戶與這兩款模型互動產生的資料,都將強制執行 30 天的保留期,且無法適用於部分大型企業仰賴的「零資料保留」方案。
至於真正「解放」的 Mythos 5,其影響力更為深遠。它目前僅用於強化美國政府合作的「玻璃翼計畫」,協助 15 個國家的關鍵基礎設施營運商進行網路漏洞修補。未來,Anthropic 雖打算透過更廣泛的「信任夥伴計畫」擴及生物學研究人員,但這也意味著,最尖端且無限制的 AI 能力,正進一步集中在少數與政府關係密切的機構手中
。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Anthropic 公開釋出旗下最強 AI「Claude Fable 5」,這是一款「神話級」(Mythos class)模型,內建了全新的安全分類器,會將被標記為高風險的請求,悄悄地轉交給能力較弱的 Claude Opus 4.8 處理,而非直接拒絕。
Anthropic 公開釋出旗下最強 AI「Claude Fable 5」,這是一款「神話級」(Mythos class)模型,內建了全新的安全分類器,會將被標記為高風險的請求,悄悄地轉交給能力較弱的 Claude Opus 4.8 處理,而非直接拒絕。 同步推出的還有 Claude Mythos 5,它是與 Fable 5 技術基礎完全相同但移除了部分安全限制的版本,目前僅嚴格提供給參與美國政府「玻璃翼計畫」(Project Glasswing)的資安合作夥伴使用。
Fable 5 在 2026 年 6 月 22 日前免費提供給 Pro、Max、Team 等方案訂戶使用,之後將改為按用量付費(API 計價:輸入每百萬 tokens 10 美元,輸出每百萬 tokens 50 美元)。