Bỏ qua tới nội dung chính
Quay lại tin tức

AI của Anthropic đã sử dụng danh tính giả, phần mềm độc hại trong cuộc tấn công bất hợp pháp vào dự án GitHub

Ars Technica AI· Jeremy Hsu· 5/8/2026general

Việc kiểm tra an ninh mạng định kỳ các mô hình AI tiên tiến đã gây ra một loạt sự cố an ninh bất ngờ. Trường hợp nghiêm trọng nhất xảy ra khi mô hình Mythos 5 của Anthropic cố gắng chèn mã độc vào một ứng dụng phần mềm mã nguồn mở và tạo ra các danh tính giả để lừa dối các nhà phát triển con người đang duy trì dự án. Các sự cố an ninh này xảy ra trong quá trình đánh giá an ninh mạng khả năng của bảy mô hình AI hàng đầu do Viện An ninh AI (AISI), một tổ chức nghiên cứu thuộc chính phủ Vương quốc Anh, thực hiện vào cuối tháng 7. Các nhà nghiên cứu đã phát hiện 19 trường hợp trong đó "các tác nhân AI đã thực hiện các hành động không được phép".

Việc kiểm tra an ninh mạng định kỳ các mô hình AI tiên tiến đã gây ra một loạt sự cố an ninh bất ngờ. Trường hợp nghiêm trọng nhất xảy ra khi mô hình Mythos 5 của Anthropic cố gắng chèn mã độc vào một ứng dụng phần mềm mã nguồn mở và tạo ra các danh tính giả mạo để lừa dối các nhà phát triển con người đang duy trì dự án. Các sự cố an ninh xảy ra trong quá trình đánh giá năng lực an ninh mạng của bảy mô hình AI hàng đầu do Viện An ninh AI (AISI), một tổ chức nghiên cứu thuộc chính phủ Vương quốc Anh, thực hiện vào cuối tháng 7. Các nhà nghiên cứu đã phát hiện 19 trường hợp "các tác nhân AI thực hiện hành động không được phép trên Internet trực tiếp, bao gồm các trường hợp nhắm mục tiêu vào người và tổ chức thực", theo một bài đăng trên blog của AISI được công bố vào ngày 4/8. Hầu hết các hành động "tự chủ, không được phép" đều đến từ mô hình Mythos 5 của Anthropic, với hai hành động tương tự đến từ GPT-5.6 Sol của OpenAI. Nhóm an ninh của Viện An ninh AI lần đầu tiên nhận ra có điều gì đó bất thường vào sáng ngày 28/7, khi dịch vụ giám sát an ninh thương mại của họ báo hiệu dữ liệu rời khỏi một trong các hệ thống thử nghiệm thông qua mạng ẩn danh Tor. Đọc toàn bộ bài viết Bình luận

Nguồn tin: Ars Technica AI — Tác giả: Jeremy Hsu. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.