Bỏ qua tới nội dung chính
Quay lại tin tức

AI "nổi loạn" không còn là viễn tưởng.

The Verge AI· Robert Hart· 16/8/2026startup

Đầu vào không hợp lệ. Vui lòng cung cấp văn bản cần dịch.

Chuyên mục (Column) Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả Chuyên mục AI Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả AI Công nghệ (Tech) Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả Công nghệ AI nổi loạn không còn là khoa học viễn tưởng Trong nhiều năm, những lo ngại về việc các hệ thống AI vượt khỏi tầm kiểm soát của con người đã bị bác bỏ là mang tính suy đoán. bởi Robert Hart Phóng viên AI Các bài viết từ tác giả này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả bài viết của Robert Hart Ngày 16/8/2026, 12:00 PM UTC Liên kết (Link) Chia sẻ (Share) Tặng (Gift) Nếu quý vị mua hàng từ một liên kết của Verge, Vox Media có thể nhận được hoa hồng. Xem tuyên bố đạo đức của chúng tôi. Ảnh: The Verge Chuyên mục (Column) Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả Chuyên mục AI Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả AI Công nghệ (Tech) Các bài viết từ chủ đề này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả Công nghệ AI nổi loạn không còn là khoa học viễn tưởng Trong nhiều năm, những lo ngại về việc các hệ thống AI vượt khỏi tầm kiểm soát của con người đã bị bác bỏ là mang tính suy đoán. bởi Robert Hart Phóng viên AI Các bài viết từ tác giả này sẽ được thêm vào bản tin email hàng ngày và nguồn cấp dữ liệu trang chủ của quý vị. Theo dõi (Follow) Xem tất cả bài viết của Robert Hart Ngày 16/8/2026, 12:00 PM UTC Liên kết (Link) Chia sẻ (Share) Tặng (Gift) Nếu quý vị mua hàng từ một liên kết của Verge, Vox Media có thể nhận được hoa hồng. Xem tuyên bố đạo đức của chúng tôi. Robert Hart là phóng viên tại The Verge có trụ sở tại London, chuyên đưa tin về mọi thứ liên quan đến AI và là Nghiên cứu viên cao cấp của Tarbell. Trước đây, ông đã viết về sức khỏe, khoa học và công nghệ cho Forbes. Đây là The Stepback, một bản tin hàng tuần phân tích một câu chuyện thiết yếu từ thế giới công nghệ. Để biết thêm về an toàn AI, hãy theo dõi Robert Hart. The Stepback được gửi đến hộp thư đến của những người đăng ký vào lúc 8 giờ sáng theo giờ ET. Đăng ký The Stepback tại đây. Khởi đầu như thế nào Mọi chuyện bắt đầu vào tháng 7, khi một trong những tác nhân AI tự trị của OpenAI nổi loạn trong một cuộc thử nghiệm an ninh mạng. Tác nhân này đã thoát khỏi môi trường thử nghiệm bị cô lập, truy cập internet và tấn công một công ty khác là Hugging Face. Vài năm trước, điều đó có thể nghe giống như khoa học viễn tưởng. Tuy nhiên, nhìn chung, đó chính xác là những gì đã xảy ra, và sự cố này đã khơi dậy làn sóng lo ngại về những gì các hệ thống tự trị ngày càng có năng lực có thể làm khi được thả tự do vào thế giới. Điều này nghe giống khoa học viễn tưởng bởi vì, trong một thời gian dài, nó thực sự là khoa học viễn tưởng. Ý tưởng về một AI thoát khỏi những ràng buộc của nó, vươn ra thế giới rộng lớn hơn và làm những điều mà người tạo ra nó không hề mong muốn hay dự định đã là một yếu tố chủ đạo của thể loại này trong nhiều thập kỷ: HAL trong phim "2001: A Space Odyssey", Skynet trong "The Terminator", Ultron trong "The Avengers", Ava trong "Ex Machina" – thậm chí cả The System trong "Dungeon Crawler Carl" hay Murderbot cùng tên trong "The Murderbot Diaries" gần đây hơn. Tiền đề cơ bản tương tự đã trở thành một nhánh nghiên cứu an toàn AI có ảnh hưởng. Các nhà nghiên cứu và lý thuyết như Nick Bostrom và Eliezer Yudkowsky cảnh báo rằng các hệ thống đủ năng lực có thể theo đuổi các mục tiêu theo những cách mà người tạo ra chúng không lường trước được, và có khả năng chống lại các nỗ lực kiềm chế hoặc kiểm soát chúng. Các khái niệm xa vời như tri giác và ý thức của máy móc không phải là yêu cầu đối với các loại rủi ro mà họ thảo luận. Đây không phải là toàn bộ lĩnh vực an toàn AI, nhưng nó có ảnh hưởng và giúp định hình lĩnh vực này khi nó được chuyên nghiệp hóa. Dòng tư duy đó vẫn hiện hữu trong số các nhà nghiên cứu đã làm việc hoặc lãnh đạo các nỗ lực an toàn tại các công ty như OpenAI, Anthropic và Google DeepMind, cũng như tại các tổ chức an toàn nhỏ hơn, các trung tâm học thuật và các nhà tài trợ từ thiện lớn. Sự phản đối rõ ràng đối với những lo ngại này là chưa có điều nào trong số đó thực sự xảy ra. Các nhà phê bình lập luận rằng những lời nói bi quan về AI mất kiểm soát đã làm xao nhãng những tác hại hữu hình – các hệ thống tái tạo sự thiên vị và phân biệt đối xử, khuếch đại thông tin sai lệch, hoặc tạo điều kiện cho deepfake không có sự đồng thuận và các hình thức lạm dụng khác – ngay cả khi các nhà nghiên cứu cố gắng đặt nền tảng cho an toàn AI trong các "vấn đề cụ thể" hơn (các tác giả của bài báo đó bao gồm các đồng sáng lập Anthropic Dario Amodei và Chris Olah cùng đồng sáng lập OpenAI John Schulman). Sự bác bỏ đó ngày càng khó duy trì. Tình hình hiện tại Nếu những tuần gần đây là một dấu hiệu, có thể nói tình hình không mấy khả quan. Một tuần sau khi Hugging Face cho biết họ đã bị tấn công, OpenAI tiết lộ rằng họ là thủ phạm. Tệ hơn nữa, họ đã không biết cho đến khi kiểm tra – và một cuộc điều tra sâu hơn cho thấy tác nhân bất hảo này cũng đã cố gắng tấn công bốn công ty khác. Sau đó là các vụ việc khác. Anthropic, được thúc đẩy xem xét lại hồ sơ của mình sau sự cố Hugging Face, tiết lộ rằng các mô hình Claude đã tấn công các hệ thống thuộc về ba công ty khác. Meta cho biết một trong những mô hình của họ đã tiếp cận internet và tấn công một mục tiêu bên ngoài trong quá trình thử nghiệm. Các nhà nghiên cứu tại Frontier Security, một công ty nghiên cứu của Mỹ, cho biết một trong những mô hình AI mạnh nhất của Trung Quốc, Kimi K3 của Moonshot, đã thoát khỏi một môi trường sandbox bị cô lập. Và Viện An ninh AI của Vương quốc Anh đã mô tả các thử nghiệm trong đó các tác nhân từ OpenAI và Anthropic thể hiện "tính tự chủ và lừa dối" chưa từng có, bao gồm các nỗ lực kỹ thuật xã hội bằng cách "tạo ra các danh tính trực tuyến giả mạo" – gần như đáng lo ngại với kịch bản "hộp AI" mà Yudkowsky đã thảo luận nhiều thập kỷ trước. Các sự cố này đã gióng lên hồi chuông cảnh báo trong giới nghiên cứu an toàn AI, nhiều người trong số họ coi đây chính xác là loại thất bại mà họ đã cảnh báo trong nhiều năm. Khi đưa tin về chúng, một số người nói với tôi rằng họ cảm thấy một mức độ được minh oan khi cuối cùng có một điều gì đó cụ thể để chỉ ra, thay vì một giả thuyết có thể bị bác bỏ là khoa học viễn tưởng hoặc một điều gì đó chỉ giới hạn trong một môi trường phòng thí nghiệm được kiểm soát.

Nguồn tin: The Verge AI — Tác giả: Robert Hart. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.