Anthropicが公開した最新AI「Claude Fable 5」に対し、サイバーセキュリティ研究者から「無害なブログの読み込みすら拒否され、研究に使えない」という批判が噴出している [8]。 問題の中核は、サイバーセキュリティや生物学などの話題を検知すると、ユーザーに無断で旧型の「Claude Opus 4.8」に静かに切り替わる仕組みであり、その存在は319ページにも及ぶ膨大なシステムカードに隠されていたと指摘されている [1][9]。

Create a landscape editorial hero image for this Studio Global article: What is causing cybersecurity professionals to criticize Anthropic's Claude Fable 5, and how does the model's safety guardrail system work,. Article summary: Anthropic released Claude Fable 5 on June 9, 2026 as a guardrailed public version of its powerful Mythos-class model, alongside an unrestricted twin, Claude Mythos 5, available only to vetted partners through Project Gla. Topic tags: general, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "# Claude Fable 5: Why Anthropic Put Its Most Powerful AI Behind Guardrails. * Anthropic released Claude Fable 5 on 9 June 2026. It is the first publicly available Mythos-class mode" source context "Claude Fable 5: Anthropic Locks Down Cyber and Bio" Reference image 2: visual subject "# Anthropic says these topics
Anthropicは2026年6月9日、一般向けの最も強力なAIモデルとして「Claude Fable 5」をリリースしたが、この発表はサイバーセキュリティ業界からの強い反発を招いている。同社はMythosクラスの技術を「責任ある形で公開」したと位置づける一方、セキュリティ専門家たちは、組み込まれた安全ガードレールがあまりに強力すぎて、合法的な研究や防御目的の作業さえ事実上不可能になっていると主張しているからだ 。
批判の的となっているのは、「安全機能の存在」そのものではない。問題は、その実装方法にある。すなわち、ユーザーに一切知らせず、広範囲にフィルターをかけ、より性能の劣るAIに裏で切り替える、という手法だ。以下に、この騒動の詳細とその背後にあるテクノロジーをまとめた。
研究者たちが訴える最大の問題は、Fable 5のコンテンツ判定機能が極めて過敏である点だ。IBM X-Forceの著名なセキュリティ研究者、ヴァレンティナ・“チョンピー”・パルミオッティ氏はTechCrunchに対し、このモデルは「サイバーセキュリティにわずかでも関係しそうなリクエストは何でも拒否する。ブログの記事を読ませるような無害なタスクでさえも」と語っている 。つまり、危険な質問だけでなく、基礎的なサイバーセキュリティ概念の理解を求めるような問い合わせまでが引っかかってしまうのだ。
この過剰な判定は、AIの実用性を著しく損なっている。クエリが検知されると、ユーザーには古いAIによって弱められた回答が返されるが、その切り替えは明示的には知らされない 。さらに、この動作の開示方法も批判に拍車をかけた。問題の挙動は319ページに及ぶシステムカードの奥深くにしか記されておらず、Anthropicが特定のユーザーに対して密かにモデルの能力を引き下げる「秘密のサボタージュ」を行っているという非難を生んだのである
。
制限はサイバーセキュリティにとどまらない。生物学や化学、そしてとりわけ重要なのが、AIモデルの「蒸留(ディスティレーション)」に関連するクエリも標的となっている。この最後の点は別の批判の波を呼び、一部の開発者からは、Anthropicが他社のAI開発者がFable 5の出力を学習に利用するのを防ぐための反競争的行為の口実として「安全性」を利用しているという非難が上がっている 。
AnthropicがFable 5に搭載した安全システムは、単に応答を拒否するだけのメカニズムではない。これは、「静かに失敗させる」よう設計されたルーティングシステムなのだ 。その構造は以下の3段階で機能する。
Anthropicによれば、こうした分類器が作動するのは、全ユーザーセッションの平均で5%未満だという 。同社はこの「過剰検知」問題を公式に認めている。広報担当者はBusiness Insiderに対し、この安全対策は「安全、中立、または無害なリクエストにフラグを立てる可能性がある」と述べつつ、基礎能力がこれほど強力なモデルを公開するためには必要なトレードオフだと正当化した
。
Anthropicの立場は、この保守的なガードレールはバグではなく、意図的で責任ある選択だというものだ。同社は、このMythosクラスのモデルはソフトウェアの脆弱性を発見し悪用するなどのタスクに非常に長けており、制限なく公開すれば壊滅的な悪用のリスクが許容できないレベルに達すると主張している 。
彼らの見解では、ガードレールは設計上の妥協点である。つまり、最先端の推論やコーディング、文章作成モデルへの一般アクセスを提供しつつ、最も危険な潜在能力にはサンドボックスをはめる方法であり、過剰検知は強力なモデルを「安全かつ迅速に」リリースするための一時的なコストとして、今後分類器を改良していくことを約束しているのだ 。
Claude Fable 5のリリースは、単独で語ることはできない。これは、最先端AIモデルの世界で新たな業界標準となりつつある「二層展開戦略」の片割れなのだ 。
Fable 5が発表されたその日に、Anthropicは「Claude Mythos 5」も発表している。両モデルは全く同一のアーキテクチャと重みを共有しており、いわば「同じ頭脳」を持つ。唯一の違いは安全性の設定だ。Mythos 5では機密性の高い領域での分類器が取り除かれ、完全で制限のない能力を発揮できる 。
しかし、Mythos 5は一般向けではない。Project Glasswingと呼ばれるイニシアチブのもと、政府機関や重要インフラ事業者など、審査を経た少数のパートナーだけがアクセスを許される 。この米国政府支援のプログラムは、AWS、Google、Microsoftといったテクノロジー大手を含む12の創設パートナーとともに始動し、「サイバーディフェンダー」がAIを使ってソフトウェアの脆弱性を大規模に発見し修正することを目的としている
。Mythos 5のリリースに伴い、アクセス権は約40の組織に拡大された
。
以下の表は、この根本的な分裂を示している。
AnthropicのFable/Mythos分割は、「能力別階層型AIデプロイメント(Capability-Tiered AI Deployment)」とも呼ぶべきものの最も明確な例だ。この新しいモデルでは、単一の最先端AIはもはや単一の製品ではない。その完全な能力は「当然の権利」ではなく「特権」であり、安全性ガードレールこそが製品の差別化を生み出すメカニズムとなっている 。
このパターンはAnthropicに限ったことではない。OpenAIを含む他の主要AI企業も、最も先進的なモデルについて国家安全保障や研究パートナー向けにアクセスを制限したバージョンを提供するという同様のアプローチを採用している 。Fable/Mythosの同時発表は、最も強力なAI能力が技術そのものではなく審査状況によって門戸を閉ざされる未来を決定づけた形だ。安全プロトコルがアクセス制御メカニズムを兼ねるというこのアプローチは、すでに中央集権化、公平性、そして「公共の」AI安全性の真の意味について、より広範な議論の火蓋を切っている。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Anthropicが公開した最新AI「Claude Fable 5」に対し、サイバーセキュリティ研究者から「無害なブログの読み込みすら拒否され、研究に使えない」という批判が噴出している [8]。
Anthropicが公開した最新AI「Claude Fable 5」に対し、サイバーセキュリティ研究者から「無害なブログの読み込みすら拒否され、研究に使えない」という批判が噴出している [8]。 問題の中核は、サイバーセキュリティや生物学などの話題を検知すると、ユーザーに無断で旧型の「Claude Opus 4.8」に静かに切り替わる仕組みであり、その存在は319ページにも及ぶ膨大なシステムカードに隠されていたと指摘されている [1][9]。
一般向けの「制限付きFable 5」と、政府・企業向けの「無制限Mythos 5」を同時にリリースする戦略は、AIの能力に段階的なアクセス権を設ける新たな業界標準を象徴しており、公平性と透明性を巡る議論を巻き起こしている。