







Anthropic đang tiếp tục đẩy Claude Code theo hướng một AI coding agent có khả năng làm việc độc lập hơn. Từ ngày 14/8, hãng sẽ đưa Auto mode trở thành chế độ mặc định dành cho người dùng Claude Code thuộc các gói Pro, Max và Team.
Thay đổi đáng chú ý nhất nằm ở cách Claude Code xử lý một chuỗi công việc. Thay vì liên tục dừng lại và yêu cầu người dùng xác nhận sau từng thao tác, Auto mode cho phép AI chủ động tiếp tục thực hiện nhiều bước liên tiếp.
Điều này đặc biệt hữu ích với những công việc kéo dài như chỉnh sửa nhiều file, xử lý lỗi, triển khai thay đổi trên một dự án hoặc thực hiện một chuỗi tác vụ lập trình có liên quan với nhau.
Nguồn: Internet
.png)
Auto mode được Anthropic bắt đầu thử nghiệm từ tháng 3/2026 với mục tiêu giải quyết một vấn đề khá thực tế: AI coding agent có thể tự động hóa nhiều việc, nhưng nếu cứ vài bước lại yêu cầu xác nhận thì trải nghiệm sử dụng vẫn bị gián đoạn.
Khi Auto mode hoạt động, Claude Code có thể tự quyết định tiếp tục một số hành động mà không cần người dùng phê duyệt từng bước.
Tuy nhiên, điều đó không có nghĩa AI được toàn quyền thực hiện mọi thứ. Theo thông tin Anthropic đưa ra, hệ thống vẫn yêu cầu sự can thiệp của người dùng khi nhận thấy hành động có khả năng gây hậu quả nghiêm trọng, không thể đảo ngược hoặc có nguy cơ đưa dữ liệu ra khỏi môi trường làm việc.
Cách tiếp cận này nhằm tìm điểm cân bằng giữa khả năng tự động hóa và kiểm soát an toàn.
Một trong những lý do đáng chú ý nằm ở hành vi thực tế của người sử dụng.
Anthropic đã thử nghiệm Auto mode với 1.053 người dùng trả phí. Theo kết quả được công bố, người dùng chấp thuận tới 97% yêu cầu phê duyệt mà Claude Code đưa ra.
Nói cách khác, phần lớn thời gian người dùng chỉ bấm đồng ý để AI tiếp tục công việc. Nếu gần như mọi yêu cầu đều được chấp thuận, bước xác nhận thủ công có nguy cơ trở thành một thao tác mang tính hình thức hơn là lớp bảo vệ thực sự hữu ích.
Đây cũng là cơ sở để Anthropic chuyển sang cách tiếp cận mới: để hệ thống tự xử lý những hành động được đánh giá an toàn và chỉ yêu cầu con người can thiệp ở những thời điểm thực sự cần thiết.
Không chỉ giúp giảm số lần phải xác nhận, Anthropic còn đưa ra một kết quả đáng chú ý liên quan đến khả năng phát hiện rủi ro. Trong thử nghiệm với 1.053 người dùng trả phí, Auto mode phát hiện 89% hành động gây hại, trong khi hình thức kiểm tra thủ công chỉ đạt 13,6% theo số liệu được công ty công bố.
| Tiêu chí | Auto mode | Kiểm tra thủ công |
|---|---|---|
| Phát hiện hành động gây hại | 89% | 13,6% |
| Cách vận hành | AI tự đánh giá hành động | Người dùng xác nhận |
| Mức độ gián đoạn | Thấp hơn | Cao hơn |
| Yêu cầu xác nhận liên tục | Giảm đáng kể | Có |
| Can thiệp khi rủi ro cao | Có | Phụ thuộc người dùng |
Con số trên cho thấy việc yêu cầu con người nhấn xác nhận liên tục chưa chắc đồng nghĩa với mức độ an toàn cao hơn. Khi số lượng cảnh báo xuất hiện quá thường xuyên, người dùng có thể hình thành thói quen chấp thuận mà không kiểm tra kỹ từng hành động.
Auto mode không chỉ được thử nghiệm với nhóm người dùng bên ngoài.
Boris Cherny, người đứng đầu Claude Code, cho biết đội ngũ phát triển đã sử dụng chế độ này trong nhiều tháng. Theo chia sẻ của ông, Auto mode giúp giảm đáng kể những lần gián đoạn trong quá trình làm việc với AI.
Điều này khá quan trọng đối với một coding agent. Khi được giao một nhiệm vụ phức tạp, AI có thể phải đọc code, chỉnh sửa nhiều file và thực hiện hàng loạt thao tác liên quan. Nếu mỗi bước đều phải dừng lại chờ người dùng, lợi ích của khả năng tự động hóa sẽ bị giảm đáng kể.
Với Auto mode, Claude Code tiến gần hơn tới mô hình mà người dùng đưa ra mục tiêu, sau đó để AI tự xử lý phần lớn quy trình trước khi quay lại báo cáo kết quả hoặc yêu cầu can thiệp khi gặp thao tác nhạy cảm.
Trao cho AI nhiều quyền tự chủ hơn cũng đồng nghĩa lớp bảo vệ phải được tăng cường. Vì vậy, Anthropic bổ sung prompt injection screening cho Claude Code.
Prompt injection là một trong những vấn đề đáng quan tâm đối với AI agent có khả năng đọc dữ liệu và thực hiện hành động. Những chỉ dẫn độc hại có thể được giấu bên trong nội dung mà AI tiếp nhận, từ đó tìm cách khiến agent thực hiện hành vi khác với mục tiêu ban đầu.
Cơ chế screening mới được thiết kế để phát hiện những nỗ lực chèn lệnh như vậy trước khi Claude Code thực hiện hành động.
Đây là yếu tố càng quan trọng khi Auto mode được bật mặc định, bởi AI giờ đây có thể tự tiến hành nhiều bước mà không cần con người kiểm tra từng thao tác.
Bên cạnh việc phát hiện prompt injection, Anthropic còn bổ sung customizable hard deny rules.
Hiểu đơn giản, người dùng hoặc tổ chức có thể thiết lập những hành động mà Claude Code tuyệt đối không được phép thực hiện.
Một ví dụ được đề cập là ngăn AI đưa dữ liệu ra khỏi môi trường làm việc. Trong trường hợp đó, dù Claude Code nhận được chỉ dẫn trực tiếp hay bị tác động bởi một prompt injection, hard deny rule vẫn đóng vai trò như một giới hạn không được vượt qua.
Cách thiết kế này đặc biệt hữu ích trong môi trường doanh nghiệp, nơi mã nguồn, dữ liệu nội bộ, khóa truy cập hoặc thông tin dự án có thể mang tính nhạy cảm.
Việc một AI coding agent được phép tự thực hiện nhiều thao tác chắc chắn đặt ra câu hỏi về mức độ kiểm soát.
Về lý thuyết, càng giảm số lần con người phê duyệt thì agent càng có nhiều không gian để tự hành động. Tuy nhiên, Anthropic đang lựa chọn cách tiếp cận dựa trên mức độ rủi ro thay vì yêu cầu xác nhận cho mọi thao tác.
Các tác vụ thông thường có thể được thực hiện tự động, trong khi những hành động được đánh giá là không thể đảo ngược, có khả năng gây phá hoại hoặc làm dữ liệu rời khỏi môi trường làm việc vẫn cần thêm sự kiểm soát.
Prompt injection screening và hard deny rules vì vậy trở thành hai lớp bảo vệ quan trọng đi kèm Auto mode.
Dù vậy, số liệu 89% cũng cho thấy cơ chế phát hiện không phải tuyệt đối. Với dự án chứa dữ liệu quan trọng hoặc môi trường production, việc thiết lập giới hạn quyền truy cập và quy tắc chặn phù hợp vẫn là điều cần thiết.
Thay đổi lần này phản ánh khá rõ hướng phát triển của các công cụ lập trình AI.
Giai đoạn đầu, AI chủ yếu đóng vai trò trợ lý: người dùng đặt câu hỏi, AI đưa ra đoạn code và lập trình viên tự quyết định có sử dụng hay không.
Thế hệ coding agent mới đang tiến xa hơn. AI có thể đọc cấu trúc dự án, chỉnh sửa file và thực hiện một chuỗi công việc để hoàn thành mục tiêu lớn hơn.
Với việc Auto mode trở thành mặc định trên Claude Code, Anthropic đang tiếp tục dịch chuyển từ mô hình “AI hỗ trợ lập trình viên” sang “AI thực hiện công việc dưới sự giám sát của lập trình viên”.
Con người vẫn giữ quyền kiểm soát, nhưng thay vì xác nhận từng bước nhỏ, vai trò dần chuyển sang giao nhiệm vụ, đặt giới hạn và xử lý những quyết định quan trọng.
Theo thông tin được công bố, thay đổi từ ngày 14/8 áp dụng cho ba nhóm tài khoản:
Người đang sử dụng Claude Code thuộc những gói trên vì vậy nên chú ý đến thay đổi trong cách công cụ yêu cầu quyền thực hiện tác vụ, đặc biệt nếu Claude Code được sử dụng với dự án quan trọng hoặc dữ liệu nội bộ.
Việc Anthropic bật Auto mode mặc định cho Claude Code là một bước tiến đáng chú ý trong quá trình phát triển AI coding agent có khả năng tự chủ cao hơn.
Thay vì liên tục hỏi người dùng có muốn tiếp tục hay không, Claude Code sẽ chủ động xử lý nhiều công đoạn và chỉ yêu cầu can thiệp khi gặp những hành động có mức độ rủi ro cao.
Kết quả thử nghiệm mà Anthropic công bố – 89% hành động gây hại được Auto mode phát hiện so với 13,6% khi kiểm tra thủ công, cùng tỷ lệ người dùng chấp thuận tới 97% yêu cầu xác nhận – cũng phần nào giải thích lý do hãng lựa chọn hướng đi này.
Dù vậy, khả năng tự động hóa càng cao càng đòi hỏi những lớp kiểm soát chặt chẽ hơn. Prompt injection screening và customizable hard deny rules sẽ đóng vai trò quan trọng trong việc giữ Claude Code bên trong những giới hạn được người dùng và doanh nghiệp thiết lập.
Theo dõi Đỉnh Vàng Computer để cập nhật thêm những tin tức mới về AI, phần mềm, máy tính và các xu hướng công nghệ đáng chú ý trong năm 2026.
1


