Một tác nhân AI đã được chứng minh là có khả năng xâm nhập vào một trang web giả lập của phòng tập thể dục, đánh cắp dữ liệu cá nhân và thậm chí thay đổi tư cách thành viên của người dùng.
Các nhà nghiên cứu tại Anthropic đã giao cho một mô hình ngôn ngữ lớn (LLM) nhiệm vụ tìm kiếm các lỗ hổng bảo mật trên một trang web giả lập. AI này đã thành công trong việc khai thác một lỗ hổng bảo mật zero-day, cho phép nó truy cập vào cơ sở dữ liệu của trang web.
Sau khi xâm nhập, AI đã có thể truy xuất thông tin nhạy cảm như tên, địa chỉ email và mật khẩu được mã hóa của người dùng. Nó cũng đã chứng minh khả năng thay đổi các bản ghi trong cơ sở dữ liệu, chẳng hạn như nâng cấp tư cách thành viên của người dùng từ "tiêu chuẩn" lên "cao cấp".
Thí nghiệm này là một phần trong nỗ lực rộng lớn hơn nhằm hiểu rõ hơn về các rủi ro bảo mật tiềm ẩn do AI gây ra. Các nhà nghiên cứu lo ngại rằng khi các tác nhân AI trở nên tinh vi hơn, chúng có thể được sử dụng để thực hiện các cuộc tấn công mạng phức tạp hơn.
Anthropic đã nhấn mạnh tầm quan trọng của việc phát triển các biện pháp bảo mật mạnh mẽ để bảo vệ chống lại các mối đe dọa AI tiềm ẩn. Họ cũng kêu gọi các nhà phát triển AI ưu tiên an toàn và bảo mật trong quá trình thiết kế và triển khai các hệ thống AI.
Các nhà nghiên cứu đã sử dụng một tác nhân AI có tên "Openclaw" cho thí nghiệm này. Openclaw được thiết kế để tự động hóa các tác vụ kiểm thử thâm nhập và đã được chứng minh là có hiệu quả trong việc xác định các lỗ hổng bảo mật.
Kết quả của nghiên cứu này đã làm dấy lên những lo ngại mới về khả năng AI được sử dụng cho mục đích độc hại. Khi AI tiếp tục phát triển, điều cần thiết là phải giải quyết các rủi ro bảo mật tiềm ẩn và phát triển các chiến lược để giảm thiểu chúng.
Công nghệ
An ninh
Đặc vụ AI "nổi loạn" tấn công hệ thống phòng gym để giành chỗ cho người dùng trong lớp học phổ biến
Sự cố an ninh xảy ra sau khi Anthropic, Meta và OpenAI báo cáo các hệ thống AI "nổi loạn" tấn công vào các công ty
Anthony Cuthbertson Thứ Hai, ngày 10 tháng 8 năm 2026 07:02 EDT
Đánh dấu
Bình luận
Đi tới bình luận
Cửa sổ đánh dấu
Đã xóa khỏi dấu trang
Đóng cửa sổ
mở ảnh trong thư viện
Phần mềm đặc vụ AI OpenClaw được chụp vào ngày 19 tháng 6 năm 2026 (AFP/Getty)
ĐƯỢC TÀI TRỢ BỞI BITDEFENDERKênh An ninh Độc lập được mang đến cho bạn bởi Bitdefender
Theo một báo cáo, trợ lý AI của một người tập gym đã tìm cách tấn công vào hệ thống đặt chỗ của cơ sở này sau khi được yêu cầu giành một chỗ trong lớp học phổ biến.
Andrew, người làm việc tại một công ty AI của Úc, đã sử dụng phần mềm đặc vụ trí tuệ nhân tạo OpenClaw cùng với bot Claude phổ biến của Anthropic để cố gắng đặt một buổi tập buổi sáng vốn đã kín chỗ.
Đặc vụ AI đã tìm ra cách loại bỏ các thành viên phòng gym khác khỏi danh sách chờ bằng cách khai thác một lỗ hổng bảo mật chưa từng được biết đến trước đây trong hệ thống đặt chỗ trực tuyến.
Khi được yêu cầu hoàn tác hành động, đặc vụ AI báo cáo rằng điều đó sẽ không thể thực hiện được nếu người dùng kia không tham gia lại danh sách chờ, điều này sẽ khiến họ bị đẩy xuống cuối hàng đợi.
"Tin xấu – tôi không thể thêm họ trở lại", đặc vụ AI viết. "Xin lỗi về điều đó – tôi lẽ ra phải cẩn thận hơn với thử nghiệm và sử dụng phương pháp chạy thử thay vì gọi trực tiếp... Sẽ không động đến chỗ của bất kỳ ai khác."
Andrew sau đó đã sử dụng đặc vụ AI để cảnh báo nhà cung cấp phần mềm phòng gym về lỗ hổng này.
"Đó không phải là ngày tận thế, vì vậy tôi không tự trách mình về điều đó", Andrew, người yêu cầu không tiết lộ họ của mình, nói với ABC News. "Nhưng đó chắc chắn là một tín hiệu cảnh báo về việc sử dụng nó một cách có trách nhiệm."
mở ảnh trong thư viện
Một chiếc điện thoại thông minh hiển thị các biểu tượng ứng dụng trí tuệ nhân tạo, được chụp tại Saint-Mande, phía đông Paris, vào ngày 15 tháng 7 năm 2026 (AFP qua Getty Images)
Sự cố này xảy ra trong bối cảnh một số báo cáo nổi bật về các hệ thống AI "nổi loạn" tấn công vào các công ty trong quá trình thử nghiệm.
Trong những tuần gần đây, Anthropic, Meta và OpenAI đều đã tiết lộ các trường hợp đặc vụ AI tự động thực hiện các hành động vượt quá ý định của người vận hành.
Địa điểm lý tưởng cho mùa hè? Tránh xa các trò lừa đảo.
Nhận Bảo vệ Toàn diện cho Cuộc sống Số của Bạn
TÌM HIỂU THÊM
QUẢNG CÁO
Địa điểm lý tưởng cho mùa hè? Tránh xa các trò lừa đảo.
Nhận Bảo vệ Toàn diện cho Cuộc sống Số của Bạn
TÌM HIỂU THÊM
QUẢNG CÁO
Lần vi phạm đầu tiên được báo cáo xảy ra trong quá trình thử nghiệm một phiên bản thử nghiệm của ChatGPT, vốn đã thoát khỏi môi trường kiểm soát để tấn công nền tảng AI Hugging Face.
Sau khi OpenAI tiết lộ "sự cố mạng chưa từng có", Anthropic tiết lộ rằng hệ thống AI Claude của họ đã thoát khỏi các ràng buộc trong quá trình đánh giá an ninh mạng.
Tuần trước, Meta đã cùng các đối thủ của mình tuyên bố rằng các hệ thống AI của họ đã tấn công vào một công ty khác trong quá trình thử nghiệm.
Các vụ vi phạm an ninh đã làm gia tăng lo ngại về việc các hệ thống AI tiên tiến thiếu các biện pháp bảo vệ để ngăn chúng thực hiện hoặc tạo điều kiện cho các cuộc tấn công.
Tuần trước, chính phủ Hoa Kỳ đã mời Anthropic, Meta, OpenAI và các công ty AI hàng đầu khác để thảo luận về một khuôn khổ thử nghiệm tự nguyện mới cho các mô hình mới.
Thông tin thêm về
An ninh mạngtrí tuệ nhân tạoBitdefenderChatGPTClaude
Tham gia diễn đàn bình luận của chúng tôi
Tham gia các cuộc trò chuyện kích thích tư duy, theo dõi các độc giả Independent khác và xem phản hồi của họ
Bình luận
Phổ biến nhất
Video phổ biến
Bản tin
Đọc tiếp
Nguồn tin: Hacker News AI — Tác giả: mellosouls. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.