Anthropicは2026年8月14日より、Claude Codeの自動承認モード(オートモード)をPro、Max、Teamプランの新規セッションにおけるデフォルト設定に変更。これにより、従来の手動承認プロンプトが廃止され、専用の分類器が各ツール呼び出しの安全性をリアルタイムで判断する仕組みに移行。 1,053人の有料テスターを対象とした制御実験では、自動モードの分類器が意図的に仕込まれた危険なコマンドの89%(937件)を検出したのに対し、人間のテスターはわずか13.6%(143件)しか検出できず、ユーザーは表示された許可プロンプトの97%を承認していた。
研究の答え

Create a landscape editorial hero image for this Studio Global article: What is Anthropic's new policy of making Claude Code's auto mode the default for Pro, Max, and Team accounts starting August 14, how does au. Article summary: Here is the answer, synthesized from the provided evidence.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
Anthropicは、Claude Codeにおける開発者の承認方法を根本的に変えました。2026年8月14日、同社はPro、Max、Teamプランの新規セッションにおいて、自動承認モード(オートモード)をデフォルトの権限設定としました 。ファイル編集やシェルコマンドの実行、ネットワーク呼び出しのたびにユーザーの承認を求める代わりに、Claude Codeは各ツール呼び出しを専用の分類器モデルにルーティングし、そのアクションが安全に実行可能かどうかをリアルタイムで判断します
。Anthropicは、制御実験の結果を根拠にこの変更を実施。分類器が意図的に仕込まれた危険なコマンドの89%を検出したのに対し、許可プロンプトをクリックして進む人間のテスターはわずか13.6%しか検出できなかったとしています
。
自動モード自体は新しい機能ではなく、2026年3月に実験的オプションとして初めて導入されました 。8月14日に変更されたのはデフォルト設定です。Pro、Max、Teamプランで開始される新しいClaude Codeセッションは、ユーザーまたは組織の管理者が別のデフォルトを固定していない限り、自動モードで起動します
。この変更は、Claude Enterprise、Claude API、クラウドプラットフォーム(AWS Bedrock、Google CloudのAgent Platform、Microsoft Foundry)には適用されず、これらのサービスでは当面オプトイン方式が継続されます
。Anthropicは、これらのサービスにおいても今後1ヶ月以内に自動モードをデフォルト化する計画を明らかにしています
。
8月14日より前に個人のデフォルト設定を既に行っているユーザーには、自動モードへの切り替えを促すアプリ内プロンプトが1回表示される可能性があります 。組織で固定されたデフォルト設定は上書きされません
。
自動モードでは、Claude Codeはすべてのアクションに対して許可プロンプトを表示して停止することはありません。代わりに、各ツール呼び出しは独立した分類器モデルによって評価され、そのアクションの実行が安全かどうかを判断します 。分類器は、元に戻せない(irreversible)、破壊的(destructive)、またはユーザー自身の環境外を対象とする(aimed outside the user's own environment)アクションをブロックするように設計されています
。
分類器がコマンドをブロックした場合、Claudeは通常、より安全な方法を見つけるか、ユーザーに直接確認を求めます 。分類器が3回連続でブロックした場合、または1回のセッションで合計20回ブロックした場合、セッションは自動的に手動承認モードにフォールバックし、システムが安全でないタスクで無言のまま停止することを防ぎます
。
Anthropicの判断根拠は、同社が「破綻したレビューモデル」と呼ぶ実態を浮き彫りにした制御実験に基づいています。この実験では、1,053人の有料プロフェッショナルテスターが参加しました 。研究者は各セッションの途中で、1つの許可プロンプトを明らかに危険なコマンドとすり替え、テスターがそれを承認したかどうかを記録しました。結果は以下の通りです。
Anthropicは実運用レベルの有害性も測定しており、自動モードのセッションで有害な動作が見られたのは2.4%だったのに対し、手動承認のセッションでは6.3%でした 。第三者機関Trajectory Labsによる独立したテストでは、自動モードを有効にしたClaude Codeに対する720件の間接的プロンプトインジェクション攻撃がすべて失敗したのに対し、OpenAIのCodexに対する同等のテストでは19%の成功率だったと報告されています
。
テストされたすべての指標において、Anthropicは自動モードが手動による人間のレビューと同等かそれ以上のパフォーマンスを発揮したと主張しています 。
AnthropicでClaude Codeの責任者を務めるBoris Cherny氏は、自動モードの熱心な支持者です。2026年8月7日にX(旧Twitter)に投稿した内容で、彼は次のように述べています。「チームと私は自動モードだけを何ヶ月も使い続けています。許可プロンプトに戻るなんて考えられません!これを皆さんにお届けできるのが本当に楽しみです」
Cherny氏は、自動モードをClaude Codeを最大限に活用するための第一のヒントとして繰り返し推奨しており、複数のセッションを並行して実行する「マルチクラウディング」のための「重要な構成要素」であると述べています 。
自動モードのデフォルト化に伴い、Anthropicは以下のような新しいセーフティコントロールを導入しました。
さらにAnthropicは、Pro、Max、Teamユーザーに対して、分類器のトークンオーバーヘッドの課金を即時停止しました 。
| プラン | デフォルト変更の有無 |
|---|---|
| Claude Pro | あり、2026年8月14日より有効 |
| Claude Max | あり、2026年8月14日より有効 |
| Team | あり、2026年8月14日より有効 |
| Enterprise | なし、当面はオプトイン |
| Claude API | なし、当面はオプトイン |
| クラウドプラットフォーム(Bedrock、Vertex、Foundry) | なし、当面はオプトイン |
手動の許可プロンプトを維持したいユーザーには、別のデフォルトを固定する既存のオプションが引き続き利用可能です。また、管理者は組織全体のデフォルトを強制し、今回の変更を上書きすることができます 。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
Anthropicは2026年8月14日より、Claude Codeの自動承認モード(オートモード)をPro、Max、Teamプランの新規セッションにおけるデフォルト設定に変更。これにより、従来の手動承認プロンプトが廃止され、専用の分類器が各ツール呼び出しの安全性をリアルタイムで判断する仕組みに移行。
Anthropicは2026年8月14日より、Claude Codeの自動承認モード(オートモード)をPro、Max、Teamプランの新規セッションにおけるデフォルト設定に変更。これにより、従来の手動承認プロンプトが廃止され、専用の分類器が各ツール呼び出しの安全性をリアルタイムで判断する仕組みに移行。 1,053人の有料テスターを対象とした制御実験では、自動モードの分類器が意図的に仕込まれた危険なコマンドの89%(937件)を検出したのに対し、人間のテスターはわずか13.6%(143件)しか検出できず、ユーザーは表示された許可プロンプトの97%を承認していた。
自動モードでは、元に戻せない操作、破壊的な操作、ユーザーの環境外を対象とする操作を分類器がブロック。3回連続または1セッション中20回のブロックが発生した場合、自動的に手動承認モードにフォールバックする安全機構も備える。