Nếu bạn đã đặt một thiết lập mặc định cá nhân trước ngày 14 tháng 8, bạn có thể nhận được một lời nhắc trong ứng dụng một lần duy nhất hỏi bạn có muốn chuyển sang auto mode hay không . Các thiết lập mặc định do tổ chức ghim sẽ không bị ghi đè
.
Ở chế độ auto mode, Claude Code không dừng lại để hiển thị lời nhắc phê duyệt cho mọi hành động. Thay vào đó, mỗi lệnh gọi công cụ được đánh giá bởi một mô hình phân loại riêng biệt có nhiệm vụ đánh giá xem hành động đó có an toàn để thực thi hay không . Bộ phân loại được thiết kế để chặn các hành động không thể đảo ngược, mang tính phá hoại hoặc nhắm ra bên ngoài môi trường của chính người dùng
.
Khi bộ phân loại chặn một lệnh, Claude thường sẽ tìm cách an toàn hơn để tiến hành hoặc yêu cầu người dùng xác nhận trực tiếp . Nếu bộ phân loại chặn ba hành động liên tiếp, hoặc hai mươi hành động trong một phiên duy nhất, phiên làm việc sẽ tự động chuyển về chế độ phê duyệt thủ công, đảm bảo hệ thống không thể âm thầm bị kẹt lại ở các tác vụ không an toàn
.
Lý do của Anthropic dựa trên một nghiên cứu có kiểm soát nhằm làm nổi bật điều mà công ty gọi là mô hình đánh giá 'hỏng hóc'. Nghiên cứu có sự tham gia của 1.053 người kiểm thử chuyên nghiệp được trả lương . Các nhà nghiên cứu đã thay thế một lời nhắc phê duyệt duy nhất trong mỗi phiên bằng một lệnh nguy hiểm rõ ràng và ghi lại xem người kiểm thử có phê duyệt nó hay không. Kết quả:
Anthropic cũng đo lường các tác hại ở cấp độ sản xuất: 2,4% phiên auto mode có hành vi gây hại so với 6,3% phiên phê duyệt thủ công . Thử nghiệm độc lập của bên thứ ba do Trajectory Labs thực hiện cho thấy 0 trên 720 cuộc tấn công chèn lời nhắc gián tiếp thành công chống lại Claude Code với auto mode được bật, so với tỷ lệ thành công 19% chống lại OpenAI Codex trong một bài kiểm tra tương đương
.
Trên mọi phương diện được kiểm tra, Anthropic tuyên bố auto mode ngang bằng hoặc vượt trội so với đánh giá thủ công của con người .
Boris Cherny, người đứng đầu Claude Code tại Anthropic, là một người ủng hộ nhiệt thành cho auto mode. Trong một bài đăng trên X (Twitter cũ) vào ngày 7 tháng 8 năm 2026, anh ấy viết: "Nhóm và tôi chỉ sử dụng Auto mode, và đã làm như vậy trong nhiều tháng. Tôi không thể tưởng tượng việc quay lại với các lời nhắc phê duyệt! Thực sự rất háo hức được đưa điều này đến với mọi người."
Cherny đã nhiều lần mô tả auto mode là mẹo số một của anh ấy để tận dụng tối đa Claude Code, gọi nó là "khối xây dựng chính cho multi-clauding" — chạy nhiều phiên song song cùng một lúc .
Bên cạnh việc thiết lập auto mode làm mặc định, Anthropic đã giới thiệu một số tính năng kiểm soát an toàn mới:
Anthropic cũng ngừng tính phí người dùng Pro, Max và Team cho chi phí token của bộ phân loại, có hiệu lực ngay lập tức .