
Anthropic đặt Claude Code ở chế độ Tự động theo mặc định để bảo vệ các nhà phát triển khỏi những phê duyệt không phù hợp.
Từ ngày 14/8, Anthropic sẽ đặt Chế độ tự động (Auto Mode) trong Claude Code làm mặc định cho các gói Pro, Max và Team. Công ty cho biết điều này an toàn hơn. Trong các thử nghiệm, bộ phân loại đã phát hiện 89% các lệnh nguy hiểm, trong khi người đánh giá thủ công chỉ phát hiện được 13,6%. Đối với công cụ mã hóa AI được sử dụng rộng rãi nhất, điều này có nghĩa là các nhà phát triển đang chuyển từ việc viết mã sang giám sát đầu ra của AI. Bài viết Anthropic đặt Claude Code ở Chế độ tự động theo mặc định để bảo vệ các nhà phát triển khỏi các phê duyệt xấu lần đầu tiên xuất hiện trên The Decoder.
Anthropic đặt Claude Code ở chế độ Tự động theo mặc định để bảo vệ nhà phát triển khỏi các phê duyệt không mong muốn
Claude Code sẽ sớm chạy ở chế độ Tự động theo mặc định. Chỉ khách hàng Doanh nghiệp mới cần chọn tham gia. Thay đổi này có nghĩa là AI sẽ tự động xử lý nhiều hơn các quy trình phát triển.
Chế độ Tự động cho phép công cụ mã hóa AI tự hoạt động mà không cần chờ phê duyệt thủ công ở mỗi bước. Một bộ phân loại sẽ kiểm tra xem một hành động có nguy hiểm hoặc không thể đảo ngược hay không và chỉ yêu cầu xác nhận trong những trường hợp đó.
Bắt đầu từ ngày 14/8, Claude Code sẽ được xuất xưởng với chế độ Tự động được bật theo mặc định cho các gói Pro, Max và Team, như Anthropic đã thông báo trong một bài đăng trên blog. Trong các thử nghiệm với 1.053 người thử nghiệm trả phí và nhóm kiểm tra nội bộ, chế độ Tự động hoạt động an toàn ít nhất bằng các phê duyệt thủ công, và thường tốt hơn. Các nhóm sử dụng chế độ Tự động cũng tạo ra nhiều yêu cầu kéo (pull requests) hơn khoảng 25%, nghĩa là họ hoàn thành được nhiều công việc hơn.
Trong một nghiên cứu có kiểm soát với 1.053 người thử nghiệm trả phí, người đánh giá thủ công chỉ phát hiện được 13,6% các lệnh nguy hiểm, trong khi chế độ Tự động phát hiện được 89%. | Hình ảnh: Anthropic
Anthropic cũng cho biết chế độ Tự động bổ sung một lớp bảo vệ chống lại các cuộc tấn công chèn lệnh (prompt injection attacks), trong đó mã được chèn cố gắng chiếm quyền điều khiển tác nhân khỏi hướng dẫn của người dùng. Một cuộc kiểm toán độc lập của Trajectory Labs đã thử nghiệm 72 kịch bản tấn công mười lần mỗi kịch bản. Không có cuộc tấn công nào trong số 720 lần thử thành công chống lại các mô hình hiện tại của Claude, Fable 5, Opus 5 và Sonnet 5, ở chế độ Tự động. Với GPT-5.6 Sol của OpenAI ở chế độ Tự động đánh giá Codex, 5,83% các cuộc tấn công đã vượt qua.
Nội bộ tại Anthropic, chế độ Tự động đã ngăn Claude tải dữ liệu bảo mật lên một trang công khai. Trong một phiên làm việc dài, nó cũng đã hủy khoảng 2.000 quy trình có thể làm gián đoạn các công việc đào tạo GPU đang diễn ra, công ty cho biết.
Anthropic không tính phí cho các token mà bộ phân loại tự tiêu thụ. Nhưng việc đặt chế độ Tự động làm mặc định có thể vẫn là một thỏa thuận tốt cho công ty. Khi Claude hoạt động lâu hơn và hoàn thành nhiều việc hơn, tổng mức sử dụng token sẽ tăng lên, và do đó doanh thu cũng tăng lên, ngay cả khi đó không phải là động lực chính của Anthropic cho sự thay đổi này.
Các nhà phát triển chuyển từ viết mã sang xem AI viết mã
Claude Code hiện là công cụ mã hóa AI được sử dụng rộng rãi nhất với một khoảng cách lớn, và việc đặt chế độ Tự động làm mặc định đẩy vai trò của nhà phát triển xa hơn khỏi việc mã hóa tích cực sang việc xem xét đầu ra do AI tạo ra. Bản thân Anthropic cũng kêu gọi thận trọng.
Bộ phân loại giảm thiểu rủi ro nhưng không loại bỏ chúng. "Đối với những thay đổi có tính rủi ro cao đối với cơ sở hạ tầng sản xuất, chúng tôi vẫn khuyên bạn nên tự xem xét các hành động của Claude", công ty viết.
Lời khuyên đó tạo ra một nghịch lý. Các nhà phát triển càng ít can thiệp, sự giám sát của họ càng quan trọng. Nhưng việc xây dựng sự hiểu biết sâu sắc về các dự án được xây dựng chủ yếu bằng chế độ Tự động mà không có nhiều sự tham gia của con người trở nên khó khăn hơn. Và an ninh mạng đang phát triển nhanh hơn và phức tạp hơn bất kỳ con người nào có thể theo kịp một cách thực tế.
Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo chuyên sâu độc quyền "AI Radar" sáu lần mỗi năm, truy cập toàn bộ kho lưu trữ và quyền truy cập vào mục bình luận của chúng tôi.
Đăng ký ngay
Nguồn: Claude

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.