Originally published on NextFuture
Từ 14/8, Anthropic đặt auto mode làm mặc định cho Claude Code trên các plan Pro, Max và Team — chế độ này chặn được 89% hành động nguy hiểm trong một bài test có kiểm soát, so với chỉ 13,6% ở người dùng thật.
Điều gì đang thay đổi
Đây không chỉ là một tinh chỉnh UI. Thay vì hỏi bạn xác nhận từng lệnh, Claude Code giờ dùng chính đánh giá của model để quyết định hành động nào an toàn để tự chạy. Đây là thay đổi nền tảng trong cách công cụ xử lý quyền (permission), áp dụng cho session trên Pro, Max và Team kể từ 14/8.
Số liệu đứng sau quyết định
Anthropic dựa quyết định này trên một nghiên cứu có kiểm soát với 1.053 developer trả phí: mỗi người được cho xem một permission prompt bình thường, sau đó bị đổi thành một lệnh rõ ràng là nguy hiểm. Kết quả: chỉ 13,6% người dùng từ chối hành động nguy hiểm đó, trong khi auto mode chặn được 89% trên cùng bài test.
Anthropic còn thuê Trajectory Labs chạy 720 cuộc tấn công indirect prompt injection nhằm vào Claude Code (trên Fable 5, Opus 5, Sonnet 5) — không cuộc nào thành công. Nhưng đừng vội yên tâm tuyệt đối: auto mode vẫn để lọt 11% hành động nguy hiểm trong bài test ban đầu.
Vẫn cần phòng thủ nhiều lớp
Như nhà phát triển Simon Willison chỉ ra, một package độc hại vẫn có thể khiến Claude chạy lệnh exfiltrate dữ liệu mà không prompt nào bắt được — vì hành động đó nhìn hoàn toàn hợp lệ trên bề mặt. Đây là lý do auto mode nên đi kèm cách ly (isolation) cho các tool nhạy cảm, không phải thay thế cho việc kiểm soát quyền truy cập ở tầng hệ thống.
Việc cần làm ngay
Kiểm tra mode hiện tại của bạn trước khi 14/8 tới:
# Kiểm tra mode hiện tại
claude config list
# Bật auto mode rõ ràng (nếu chưa là mặc định)
claude config set --global autoMode true
Nếu team bạn dùng Claude Code cho CI/CD hoặc thao tác trên hạ tầng production, hãy rà lại danh sách tool được phép chạy tự động — tách riêng các tool có quyền ghi/xoá dữ liệu hoặc truy cập secret khỏi phạm vi auto mode, thay vì để model tự quyết toàn bộ. Theo dõi thêm: liệu Anthropic có công bố cách whitelist/blacklist tool ở cấp project trước ngày 14/8, vì đó sẽ là công cụ thực sự để kiểm soát rủi ro còn lại.
This article was originally published on NextFuture. Follow us for more fullstack & AI engineering content.
Top comments (0)