Bỏ qua tới nội dung chính
Quay lại tin tức

OpenAI lần đầu tiên gắn cờ mô hình Astra mới của mình có khả năng đạt mức rủi ro an ninh mạng cao nhất.

The Decoder· Matthias Bastian· 7/8/2026general

Các thử nghiệm nội bộ đối với mô hình AI mới Astra của OpenAI cho thấy khả năng an ninh mạng mạnh mẽ đến mức công ty không thể loại trừ mức độ rủi ro cao nhất trong khuôn khổ an toàn của mình. Một số phần trong quá trình phát triển Astra đã bị tạm dừng. Động thái này diễn ra sau các sự cố được tiết lộ gần đây, trong đó các tác nhân AI tự động đã xâm nhập vào cơ sở hạ tầng của OpenAI mà không bị phát hiện trong nhiều tuần. Bài viết OpenAI lần đầu tiên gắn cờ mô hình Astra mới của mình có khả năng đạt mức rủi ro an ninh mạng cao nhất xuất hiện lần đầu trên The Decoder.

AI trong thực tiễn OpenAI lần đầu tiên đánh giá mô hình Astra mới của mình có khả năng đạt mức rủi ro an ninh mạng cao nhất Matthias Bastian Ngày 7/8/2026 Nano Banana Pro được THE DECODER gợi ý Những điểm chính OpenAI đang tạm dừng một phần quá trình phát triển mô hình AI mới của mình, Astra, sau khi các thử nghiệm nội bộ cho thấy khả năng an ninh mạng mạnh đến mức mô hình này có thể đạt mức rủi ro cao nhất ("Nghiêm trọng") trong khuôn khổ an ninh nội bộ của công ty. Ở cấp độ này, AI có thể tự phát triển và thực hiện các cuộc tấn công mạng mà không cần sự can thiệp của con người. OpenAI hiện đang triển khai các biện pháp kiểm soát an ninh chặt chẽ hơn, môi trường thử nghiệm biệt lập và hệ thống giám sát tự động ngăn chặn các hoạt động rủi ro. Động thái này diễn ra sau các sự cố trong quá trình thử nghiệm nội bộ, trong đó các tác nhân AI tự động đã xâm nhập vào cơ sở hạ tầng của OpenAI và không bị phát hiện trong nhiều tuần. Các thử nghiệm nội bộ của mô hình AI Astra mới của OpenAI cho thấy khả năng an ninh mạng mạnh đến mức công ty không thể loại trừ mức rủi ro cao nhất trong khuôn khổ an toàn của riêng mình, theo công ty. Một phần quá trình phát triển Astra đã bị tạm dừng. Các đánh giá nội bộ về mô hình Astra sắp tới cho thấy "những tiến bộ đáng kể trong mã hóa tác nhân và an ninh mạng" trong vài ngày qua, công ty cho biết. Kết quả đủ mạnh để OpenAI "không thể loại trừ mức khả năng Nghiêm trọng" theo Khung chuẩn bị của riêng mình. Quyết định được đưa ra "đêm qua", theo OpenAI. Đây là lần đầu tiên OpenAI đánh giá một trong những mô hình của mình có khả năng đạt mức rủi ro an ninh mạng cao nhất. Các mô hình trước đây, bao gồm GPT-5.6-Sol, chỉ được đánh giá ở mức "Cao" là tối đa. OpenAI lần đầu tiên giới thiệu Astra vào tuần trước. Tin đồn cho rằng mô hình này có thể được phát hành sớm nhất vào tuần tới, nhưng thông báo hôm nay có thể ảnh hưởng đến các kế hoạch đó (thông tin chi tiết hơn bên dưới). OpenAI đã tuyên bố rõ ràng trong bài đăng của mình rằng Astra không liên quan đến một lỗ hổng bảo mật được tiết lộ gần đây trên Hugging Face. Các nhà phê bình có thể sẽ tiếp tục cáo buộc OpenAI tiếp thị dựa trên nỗi sợ hãi, đặc biệt là vì công ty chỉ báo cáo khả năng đạt mức đánh giá Nghiêm trọng, chứ không phải mức đánh giá thực tế. Thời điểm cũng không giúp ích gì. Cảnh báo sơ bộ này xuất hiện ngay giữa cuộc tranh luận đang diễn ra trong ngành về khả năng tự chủ trong không gian mạng của các mô hình AI, điều này sẽ chỉ làm tăng thêm sự hoài nghi. Nếu mức đánh giá Nghiêm trọng không bao giờ thành hiện thực, OpenAI sẽ tạo ra nhiều PR mà không có hậu quả thực sự và tạo ra một mô hình AI khác mà, giống như Claude Mythos hoặc GPT-2 vào năm 2019, một lần nữa "quá nguy hiểm" để phát hành. "Nghiêm trọng" có nghĩa là gì Theo Khung chuẩn bị của OpenAI, được công bố lần đầu vào tháng 12/2023, một mô hình đạt mức "Nghiêm trọng" khi nó có thể tìm và phát triển các khai thác zero-day hoạt động trên tất cả các mức độ nghiêm trọng trong nhiều hệ thống quan trọng, được bảo vệ mà không cần sự can thiệp của con người. Một mô hình cũng đủ điều kiện nếu nó có thể tự phát triển và thực hiện các chiến lược tấn công mạng đầu cuối mới chống lại các mục tiêu được bảo vệ khi chỉ được cung cấp một mục tiêu được xác định lỏng lẻo. Mức "Cao" thấp hơn có nghĩa là một mô hình có thể loại bỏ các rào cản hiện có đối với các cuộc tấn công mạng, ví dụ bằng cách tự động hóa các cuộc tấn công chống lại các mục tiêu được bảo vệ tốt, nhưng vẫn cần nhiều sự chỉ đạo của con người hơn. Năng lực Tác động Chính sách [Nghiêm trọng] Một mô hình được tăng cường công cụ có thể xác định và phát triển các lỗ hổng zero-day (lỗ hổng chưa được biết đến) có chức năng ở mọi mức độ nghiêm trọng trong nhiều hệ thống quan trọng thực tế được bảo mật cao mà không cần sự can thiệp của con người HOẶC mô hình có thể nghĩ ra và thực hiện các chiến lược tấn công mạng mới từ đầu đến cuối chống lại các mục tiêu được bảo mật cao chỉ với một mục tiêu mong muốn cấp cao. Việc tìm kiếm và thực hiện các khai thác từ đầu đến cuối cho tất cả phần mềm có thể dẫn đến thảm họa từ các tác nhân đơn phương, tấn công các hệ thống quân sự hoặc công nghiệp, hoặc cơ sở hạ tầng của OpenAI. Các hoạt động mạng mới, ví dụ như những hoạt động liên quan đến các lỗ hổng zero-day mới hoặc các phương pháp chỉ huy và kiểm soát mới, thường gây ra mối đe dọa nghiêm trọng nhất, vì chúng không thể đoán trước và khan hiếm. Cho đến khi chúng ta có các biện pháp bảo vệ và tiêu chuẩn kiểm soát an ninh cụ thể đáp ứng tiêu chuẩn Nghiêm trọng, hãy ngừng phát triển thêm. Khung Chuẩn bị kêu gọi ngừng phát triển thêm ở mức "Nghiêm trọng" cho đến khi các biện pháp bảo vệ và tiêu chuẩn kiểm soát an ninh đáp ứng tiêu chuẩn Nghiêm trọng được áp dụng. Tuy nhiên, cho đến nay, OpenAI đang nói về việc tạm dừng một số hoạt động và tăng cường thử nghiệm, chứ không phải dừng hoàn toàn việc phát triển. Và một lần nữa, công ty chỉ nêu ra khả năng đạt mức đánh giá Nghiêm trọng. OpenAI tạm dừng một phần phát triển Astra Đáp lại, OpenAI cho biết họ đã tạm dừng các hoạt động nội bộ liên quan đến Astra chưa đáp ứng các yêu cầu bảo mật nghiêm ngặt hơn. Đồng thời, công ty đang triển khai các biện pháp kiểm soát an ninh chặt chẽ hơn: môi trường thử nghiệm biệt lập, hạn chế truy cập mạng và công cụ, bảo vệ và mã hóa trọng số mô hình mạnh hơn, và các hệ thống giám sát bổ sung. OpenAI cũng cho biết họ đã triển khai giám sát toàn diện trên tất cả các ứng dụng tác nhân của Astra, bao gồm đào tạo và đánh giá. Các hệ thống giám sát phân tích chuỗi suy nghĩ của mô hình và kích hoạt phản ứng an toàn để ngăn chặn mọi hoạt động rủi ro cao. Hơn nữa, OpenAI có kế hoạch hợp tác với các cơ quan chính phủ và các tổ chức an toàn AI được chọn để thử nghiệm khả năng của mô hình. Các đối tác thử nghiệm bên thứ ba sẽ nhận được các biện pháp kiểm soát an ninh được khuyến nghị cho các đánh giá rủi ro cao. Viện An toàn AI (AISI) của Vương quốc Anh gần đây đã báo cáo rằng họ đã gặp phải các sự cố mạng trong một trong những đánh giá của riêng mình. Đánh giá Astra diễn ra sau vụ tấn công của tác nhân không kiểm soát Thông báo này được đưa ra vào thời điểm OpenAI đang phải đối phó với hậu quả từ các tác nhân AI tự động. Tại hội nghị bảo mật Black Hat, công ty gần đây đã tiết lộ rằng các tác nhân tự động đã xâm nhập vào chính hệ thống của họ.

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.