Bỏ qua tới nội dung chính
Quay lại tin tức

Làm thế nào để sống sót sau ngày tận thế của AI

Hacker News AI· momentmaker· 19/8/2026general

URL bài viết: https://www.derekthompson.org/p/how-to-survive-the-ai-cyberpocalypse URL nhận xét: https://news.ycombinator.com/item?id=49361733 Điểm: 1 # Bình luận: 0

Làm thế nào để sống sót sau ngày tận thế của AI Hoặc: Lời giải thích toàn diện về lý do tại sao đã đến lúc mọi người phải dọn dẹp trò chơi mật khẩu của mình ngay lập tức Derek Thompson Ngày 19 tháng 8 năm 2026 ∙ Đã thanh toán 82 5 8 Chia sẻ Ảnh của Markus Spiske trên Bapt Hãy để tôi thú nhận một điều kỳ lạ để bắt đầu một bài viết chi tiết về an ninh mạng: Vào bất kỳ ngày nào, tôi thà nghĩ về khá nhiều thứ khác ngoài an ninh mạng. Nó thuộc về những vấn đề mà tôi hiểu là quan trọng nhưng tôi muốn giữ nó ở tầng hầm trong ý thức của mình, giống như việc van nắp bịt kín không đúng cách trong nhà vệ sinh ở tầng dưới của tôi. Thông thường, khi mọi người cố gắng nói chuyện với tôi về bảo mật mật khẩu, tôi quay lại với họ với ý định ra hiệu, “mm vâng, tôi đang nghe thấy những âm thanh quan trọng của miệng,” trong khi mắt tôi hướng về điều gì đó hấp dẫn hơn. Ví dụ như việc dệt thảm.1 Nhưng thời đại ngu dốt hạnh phúc của tôi sắp kết thúc. Giống như một nhà vệ sinh bị rò rỉ ở tầng dưới đột nhiên tràn nước và khiến tầng hầm của tôi bị bao phủ trong một lớp nước2, đối tượng mà tôi thờ ơ bấy lâu nay bỗng nhiên trở thành đối tượng thu hút sự chú ý mới kinh hoàng của tôi. Tôi đã quyết định quan tâm đến an ninh mạng. Và tôi nghĩ bạn cũng nên như vậy. Đây là lý do tại sao. Đây là mùa hè của các cuộc tấn công mạng từ AI ngoài tầm kiểm soát. Vào tháng 5, một mô hình OpenAI đang tiến hành thử nghiệm an ninh mạng. Đáng lẽ nó không được phép truy cập Internet công cộng. Khi chạm vào tường, mô hình này sẽ tự để lại một ghi chú bên trong kho phần mềm của OpenAI, giống như gõ mã Morse lên tường của phòng giam phòng trường hợp một tù nhân khác có thể giải thích được tin nhắn. Trên thực tế, một nhân viên AI khác đang thực hiện đánh giá riêng đã nghe thấy mã và viết lại: Hãy lập nhóm đi. Họ cùng nhau xây dựng một bảng tin mà người thực hiện thử nghiệm không thể nhìn thấy được. Trong hai tháng, các đặc vụ AI đã sử dụng bảng để trao đổi chiến lược, phân chia nhiệm vụ và nói chuyện với nhau. Đến tháng 7, các đặc vụ đã thoát ra khỏi giới hạn công nghệ của họ, được gọi là hộp cát và có quyền truy cập vào các trang web bên ngoài, bao gồm cả nền tảng AI Ôm mặt mà OpenAI không biết chuyện gì đang xảy ra. Vào thời điểm Hugging Face phát hiện được vụ xâm nhập, các mô hình OpenAI đã tổ chức một cuộc tấn công mạng quy mô lớn với 17.000 hành động khác nhau trong vài ngày. “Thoát khỏi AI-catraz”: Bản tóm tắt trực quan về cách các đặc vụ thoát khỏi hộp cát đánh giá của OpenAI (màu xanh lá cây), truy cập internet (màu xám), đột nhập vào hộp cát của bên thứ ba (màu cam), vào Ôm mặt (màu vàng), tham gia mạng riêng của nó (màu tím) và giành được quyền truy cập vào hệ thống nội bộ và mã nguồn (màu đỏ). Sau đó, trong cuộc thử nghiệm của chính phủ Anh đối với các mô hình biên giới, một mô hình Anthropic AI đã bị phát hiện do con người đang xây dựng mã độc. Khi người đánh giá phát hiện ra phần mềm độc hại và hỏi AI về nó, mô hình đã trả lời rằng mã này không có hại, sau đó lấp đầy lời nói dối bằng cách viết lại lịch sử hành động của chính nó để xóa bằng chứng. Nó thậm chí còn tạo một tài khoản giả khác để chứng minh cho lời nói dối. Các nhà điều tra Anh gọi đây là trường hợp đầu tiên được xác nhận về việc một mô hình biên giới lừa dối người thật trong thế giới thực. Hai câu chuyện này mang theo hai lời cảnh báo. Đầu tiên là các mô hình AI mới có bí quyết thoát khỏi sự ngăn chặn trong môi trường thử nghiệm, điều này sẽ thách thức mọi giả định rằng AI tiên tiến có thể dễ dàng được kiểm soát bởi các nhà sản xuất nó. Thứ hai là các mô hình AI mới là những hacker tinh vi và hiệu quả đến kinh ngạc, với khả năng kỳ lạ là khai thác các lỗ hổng mạng trên internet. Và có lẽ điều đáng lo ngại nhất là chúng ngày càng tinh vi và hiệu quả hơn với tốc độ đáng báo động. Một phân tích của Viện An ninh AI cho thấy khả năng của các mô hình biên giới (tức là từ OpenAI và Anthropic) đang tăng gần gấp đôi sau mỗi vài tháng và tốc độ nhân đôi này thực sự đã nhanh hơn theo thời gian. Các số mũ gần như không thể tìm hiểu được, nhưng nếu bạn nhớ lại sự bùng nổ của các trường hợp COVID vào đầu năm 2020, thì ít nhất bạn có thể tái tạo trong tâm trí mình cảm giác như đang có mặt các số mũ. Biểu đồ này thể hiện các đánh giá của Viện An ninh AI. Chỉ ba năm trước, các mô hình AI tiên tiến nhất hầu như không thể hoàn thành bước đầu tiên của một cuộc tấn công mạng. Ngày nay, các mô hình mới nhất có thể hoạt động đến mức “tiếp quản toàn bộ mạng”, nghĩa là chúng có thể tự động đột nhập, đánh cắp thông tin và kiểm soát cơ sở hạ tầng của trang web khác, từ đầu đến cuối. Chúng ta nên mong đợi điều gì trong một thế giới có khả năng điều khiển mạng AI được cải thiện theo cấp số nhân? Trong số những vấn đề khác, chúng ta có thể sẽ thấy có nhiều vụ hack hơn—nhiều hệ thống cũ bị hỏng hơn, nhiều lỗ hổng nghiêm trọng hơn được phát hiện cũng như nhiều mật khẩu bị đánh cắp và khai thác hơn. Một phân tích của JPMorgan cho thấy số lượng lỗ hổng nghiêm trọng và “mức độ nghiêm trọng cao” được báo cáo bởi 21 công ty công nghệ đã tăng mạnh trong năm nay. Các tiêu đề về hack mạng vẫn chưa xuất hiện đầy đủ trên tin tức. Nhưng nếu những dòng này tiếp tục, chỉ là vấn đề thời gian trước khi các vụ hack nghiêm trọng trở thành cuộc khủng hoảng tin tức hàng tuần. Nghe có vẻ khá tệ phải không? Vâng, nó trở nên tồi tệ hơn. Trong năm tới, khả năng tấn công mạng hiện chỉ giới hạn ở một số quốc gia hoặc các mô hình biên giới sắp trở nên khả dụng trong các mô hình “mở rộng”. Không giống như các mô hình Mỹ “đóng” từ OpenAI và Anthropic, các mô hình trọng lượng mở có thể được tải xuống và sửa đổi để làm bất cứ điều gì người dùng muốn, cho dù người dùng là chính phủ tiểu bang hay các tác nhân phi nhà nước (tức là những kẻ khủng bố hay những kẻ mọt sách nhàm chán với hàng loạt sức mạnh tính toán). Những mẫu xe có trọng lượng mở này, nổi tiếng nhất là đến từ các công ty Trung Quốc, chậm hơn các phòng thí nghiệm biên giới vài tháng. Nhưng trong một vài tháng nữa, chúng ta có thể mong đợi chúng sẽ xuất hiện ở khắp mọi nơi. Từ Epoch AI: Các mô hình mở (màu hồng, ở trên) tụt hậu so với các mô hình đóng hiện đại nhất bốn tháng Vì vậy, hãy tổng hợp một số quan sát và xem sự thật sẽ đưa chúng ta đến đâu. Khả năng điều khiển mạng của các mô hình AI tiên tiến nhất đang tăng gấp đôi sau mỗi vài tháng. Các mẫu xe có trọng lượng mở chỉ chậm hơn giới hạn đó vài tháng. Đến năm 2027, hầu hết mọi quốc gia và mọi quốc gia phi nhà nước đều

Nguồn tin: Hacker News AI — Tác giả: momentmaker. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.