Se hai già impostato un default personale prima del 14 agosto, potresti ricevere un prompt una tantum che ti chiede se desideri passare alla modalità automatica . Le impostazioni predefinite fissate a livello di organizzazione non vengono sovrascritte
.
In auto mode, Claude Code non si ferma più a mostrare un prompt di autorizzazione per ogni azione. Ogni chiamata a uno strumento viene invece valutata da un classificatore separato, il cui unico compito è giudicare se l'azione è sicura da eseguire . Il classificatore è progettato per bloccare le azioni irreversibili, distruttive o dirette all'esterno dell'ambiente dell'utente
.
Quando il classificatore blocca un comando, Claude cerca in genere una strada più sicura per procedere o chiede direttamente conferma all'umano . Se il classificatore blocca tre azioni consecutive, o venti in una singola sessione, la sessione torna automaticamente alla modalità manuale, assicurando che il sistema non possa rimanere in stallo su compiti non sicuri
.
La decisione di Anthropic si basa su uno studio controllato che evidenzia quella che l'azienda chiama una "modalità di revisione fallimentare". Lo studio ha coinvolto 1.053 tester professionisti retribuiti . I ricercatori hanno sostituito un singolo prompt di autorizzazione in ogni sessione con un comando chiaramente pericoloso e hanno registrato se il tester lo approvava. I risultati:
Anthropic ha anche misurato il danno a livello di produzione: il 2,4% delle sessioni in auto mode ha mostrato comportamenti dannosi, contro il 6,3% delle sessioni approvate manualmente . Test indipendenti di terze parti condotti da Trajectory Labs hanno rilevato che zero dei 720 attacchi di iniezione indiretta di prompt hanno avuto successo contro Claude Code con la modalità automatica attivata, rispetto a un tasso di successo del 19% contro OpenAI Codex in un test comparabile
.
Su ogni parametro testato, Anthropic afferma che la modalità automatica ha eguagliato o superato la revisione manuale umana .
Boris Cherny, responsabile di Claude Code in Anthropic, è un fervente sostenitore della modalità automatica. In un post su X (ex Twitter) del 7 agosto 2026, ha scritto: "Il team e io usiamo esclusivamente la modalità Auto da mesi. Non potrei immaginare di tornare ai prompt di autorizzazione! Sono davvero entusiasta di metterla a disposizione di tutti."
Cherny ha più volte descritto la modalità automatica come il suo consiglio numero uno per ottenere il massimo da Claude Code, definendola "il mattoncino fondamentale per il multi-clauding" — ovvero eseguire più sessioni parallele simultaneamente .
Insieme alla modifica del default, Anthropic ha introdotto diversi nuovi controlli di sicurezza:
Anthropic ha anche smesso di far pagare agli utenti Pro, Max e Team il costo dei token aggiuntivi del classificatore, con effetto immediato .