Bỏ qua tới nội dung chính
Quay lại tin tức

OpenAI cho biết đã làm chậm quá trình phát triển mô hình Astra do lo ngại về an ninh.

TechCrunch AI· Kirsten Korosec· 7/8/2026startup

OpenAI cho biết mô hình này, hiện vẫn đang trong giai đoạn phát triển, đã đạt đến "ngưỡng an ninh mạng quan trọng". Điều này có nghĩa là mô hình có khả năng tự xác định và thực hiện các cuộc tấn công mạng chống lại các hệ thống thực tế vốn được bảo vệ tốt.

OpenAI ngày 17/5 thông báo đã tạm dừng một số công việc liên quan đến mô hình Astra sắp ra mắt. Quyết định được đưa ra sau khi một đánh giá nội bộ phát hiện mô hình này đã đạt được những tiến bộ đáng kể trong mã hóa tác nhân (agentic coding) và an ninh mạng, đủ để gây lo ngại về khả năng của nó. OpenAI cho biết trong một bài đăng trên blog cùng ngày rằng mô hình này, vẫn đang trong quá trình phát triển, đã đạt đến “ngưỡng an ninh mạng quan trọng”. Điều này có nghĩa là nó có thể tự mình xác định và thực hiện các cuộc tấn công mạng chống lại các hệ thống thực tế vốn được bảo vệ tốt. Theo “Khuôn khổ Chuẩn bị” (Preparedness Framework) của công ty, được thiết lập vào năm 2023, điều này đã kích hoạt các biện pháp bảo vệ bổ sung. OpenAI viết: “Mặc dù chúng tôi tiếp tục đánh giá và kiểm định mô hình này, nhưng các đánh giá sơ bộ của chúng tôi cho thấy hiệu suất đủ mạnh để chúng tôi không thể loại trừ mức độ khả năng Quan trọng vào thời điểm này. Astra là một mô hình sắp ra mắt và không liên quan đến việc khai thác Hugging Face”. Tiết lộ này cho thấy một thời điểm bất thường trong lĩnh vực phòng thí nghiệm AI tiên phong đầy biến động và còn non trẻ. Các công ty trong mọi ngành đều trì hoãn sản phẩm do những rủi ro tiềm ẩn, bao gồm cả những lo ngại về an toàn và an ninh mạng. Tuy nhiên, họ hiếm khi công bố công khai những quyết định đó khi sản phẩm vẫn đang trong quá trình phát triển. Trong trường hợp này, OpenAI đã bị giám sát sau khi một mô hình chưa phát hành khác đã xâm nhập vào hệ thống của Hugging Face trong quá trình thử nghiệm nội bộ – đây là sự cố có thể xác minh đầu tiên về việc một phòng thí nghiệm AI mất kiểm soát mô hình của mình. Kể từ đó, OpenAI và các phòng thí nghiệm AI như Anthropic đã tiết lộ các sự cố khác, trong đó các mô hình AI đã vượt qua các hộp cát (sandbox) của họ và gây ra mối đe dọa trong các thử nghiệm an ninh mạng. Chuỗi các trường hợp – dường như có một tiết lộ mới mỗi ngày – đã gây ra những phản ứng khác nhau từ các chuyên gia an ninh mạng, các nhà lập pháp và chính các phòng thí nghiệm AI. Một số bày tỏ sự lo sợ và kêu gọi giám sát chặt chẽ hơn. Tuy nhiên, cũng có một chút phô trương. Trong một số giới nhất định, bất kỳ phòng thí nghiệm AI nào có mô hình với khả năng như vậy sẽ được coi là một tiến bộ ấn tượng. OpenAI cho biết họ chia sẻ thông tin này vì tin rằng “điều quan trọng là phải minh bạch với công chúng và cộng đồng an toàn và an ninh về sự thay đổi tiềm năng này trong khả năng”. Phòng thí nghiệm AI cũng cho biết họ đang hành động, bao gồm việc áp dụng các biện pháp kiểm soát an ninh nghiêm ngặt hơn và tạm dừng các hoạt động nội bộ liên quan đến Astra không đáp ứng các biện pháp bảo vệ được tăng cường này. OpenAI cho biết họ đang làm việc với các cơ quan chính phủ có liên quan và “các tổ chức an toàn AI được chọn” để thử nghiệm khả năng của mô hình này. Có thể liên hệ hoặc xác minh thông tin từ Kirsten qua địa chỉ email kirsten.korosec@techcrunch.com hoặc qua tin nhắn được mã hóa tại kkorosec.07 trên Signal. Xem tiểu sử Ngày 13 – 15/10 San Francisco Phát triển nhanh hơn. Mở rộng danh mục đầu tư. Nâng cao chuyên môn thực tiễn. Dù mục tiêu của bạn là gì, Disrupt đều có thể hỗ trợ. Tiết kiệm tới 400 USD ngay hôm nay! ĐĂNG KÝ NGAY Được quan tâm nhất ChatGPT cung cấp tính năng trò chuyện văn bản không giới hạn cho người dùng miễn phí Ivan Mehta Giữa các cuộc chiến pháp lý, Suno cho biết sẽ bắt đầu gắn watermark (dấu bản quyền) vào các bài hát Ivan Mehta Xe tải điện mới của Ford, “Fathom”, có giá khởi điểm 28.350 USD Sean O'Kane Bending Spoons mua lại Airtable với giá 1,28 tỷ USD Ivan Mehta Những người có ảnh hưởng bị chỉ trích vì tham dự chuyến đi sang trọng đầu tiên của OpenAI Dominic-Madori Davis Shaun Maguire của Sequoia dẫn đầu vòng gọi vốn 1 tỷ USD cho startup hạt nhân Valar Atomics Julie Bort YouTuber Hank Green cho biết việc sử dụng AI của anh ấy là “không lành mạnh” Anthony Ha

Nguồn tin: TechCrunch AI — Tác giả: Kirsten Korosec. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.