Bỏ qua tới nội dung chính
Quay lại tin tức

OpenAI ra mắt GPT-5.6-Cyber nhằm hỗ trợ các chuyên gia an ninh mạng phát hiện lỗ hổng trước khi tin tặc khai thác.

The Decoder· Matthias Bastian· 10/8/2026general

OpenAI đặt mục tiêu giúp các chuyên gia an ninh mạng có lợi thế dẫn đầu: Mô hình GPT-5.6-Cyber mới trả lời tới 98,5% các truy vấn bảo mật mà trước đây sẽ bị chặn và đã phát hiện hai lỗ hổng Chrome chưa từng được biết đến. Theo OpenAI, cơ hội cho các chuyên gia phòng thủ đang ngày càng thu hẹp. Việc truy cập yêu cầu xác minh danh tính. Bài viết OpenAI ra mắt GPT-5.6-Cyber để giúp các chuyên gia phòng thủ tìm lỗ hổng trước khi kẻ tấn công thực hiện xuất hiện lần đầu trên The Decoder.

AI trong thực tiễn OpenAI ra mắt GPT-5.6-Cyber nhằm giúp các chuyên gia phòng thủ phát hiện lỗ hổng trước khi kẻ tấn công thực hiện. Matthias Bastian Ngày 10/8/2026 Nano Banana Pro được tạo bởi THE DECODER Các điểm chính OpenAI đang mở rộng chương trình an ninh mạng Daybreak với hai cấp độ truy cập mới và một mô hình AI chuyên biệt có tên GPT-5.6-Cyber, được thiết kế để hỗ trợ các chuyên gia bảo mật xác định lỗ hổng và phát triển khai thác ở giai đoạn đầu. Chương trình được chia thành hai nhánh: Daybreak Blue tập trung vào các nhiệm vụ phòng thủ như phân tích phần mềm độc hại, trong khi Daybreak Red hướng tới nghiên cứu bảo mật tấn công. Thông qua cấp độ Red, người dùng có quyền truy cập vào GPT-5.6-Cyber, một mô hình được huấn luyện đặc biệt cho mục đích bảo mật tấn công, có khả năng phản hồi gần như tất cả các truy vấn bảo mật nhạy cảm mà các mô hình AI khác thường chặn. OpenAI đang mở rộng chương trình Daybreak với hai cấp độ truy cập mới và một mô hình chuyên biệt có tên GPT-5.6-Cyber. Mô hình này được thiết kế để giúp các chuyên gia phòng thủ phát hiện lỗ hổng và xây dựng các công cụ khai thác trước khi kẻ tấn công có thể triển khai các công cụ tấn công được hỗ trợ bởi AI trên quy mô lớn. OpenAI cho biết các tác nhân đe dọa sẽ ngày càng sử dụng AI cho các cuộc tấn công mạng, bao gồm cả các cuộc tấn công hoàn toàn tự động. Thời gian để các chuyên gia phòng thủ chuẩn bị đang ngày càng thu hẹp. Trớ trêu thay, ví dụ điển hình nhất cho điều này lại đến từ chính OpenAI, khi các mô hình của họ vô tình tấn công Hugging Face và các dịch vụ khác sau nhiều tuần lên kế hoạch trên các diễn đàn nội bộ. Daybreak nhằm mục đích tạo lợi thế cho các chuyên gia phòng thủ. Chương trình hiện có hai cấp độ truy cập. Daybreak Blue cung cấp cho người dùng quyền truy cập vào GPT-5.6 Sol với các biện pháp bảo vệ được điều chỉnh cho công việc phòng thủ được ủy quyền như phát hiện lỗ hổng, phân tích phần mềm độc hại và ứng phó sự cố. Daybreak Red nhắm đến các nhà nghiên cứu bảo mật thực hiện nghiên cứu lỗ hổng, xác thực khai thác và kiểm tra thâm nhập. Để tham gia bất kỳ cấp độ nào đều yêu cầu xác minh danh tính, các biện pháp bảo mật tài khoản, giám sát và các tuyên bố pháp lý. Khóa bảo mật phần cứng trở thành bắt buộc đối với tất cả các tài khoản Daybreak từ ngày 1/9/2026. OpenAI cũng khuyến nghị chạy các quy trình bảo mật trong môi trường sandbox cô lập và sử dụng chế độ Auto-Review trong Codex, chế độ này kiểm tra các hành động cần đặc quyền nâng cao trước khi chúng được thực thi. GPT-5.6-Cyber trả lời 95% các truy vấn bảo mật nhạy cảm mà các mô hình khác chặn Mô hình GPT-5.6-Cyber mới có sẵn thông qua cấp độ Daybreak Red. Nó dựa trên GPT-5.6 Sol và được huấn luyện đặc biệt để thực hiện tốt hơn các nhiệm vụ như tìm kiếm lỗ hổng zero-day và xây dựng chuỗi khai thác. Theo OpenAI, mô hình này hiếm khi từ chối các truy vấn liên quan đến bảo mật mà các mô hình khác chặn theo mặc định. GPT-5.6-Cyber trả lời 95% các truy vấn an ninh mạng nhạy cảm trong một thử nghiệm nội bộ. Trong khi đó, mô hình GPT-5.6 Sol tiêu chuẩn đã chặn gần như tất cả các truy vấn này do các biện pháp bảo vệ của nó. Trong một thử nghiệm nội bộ có tên "Tỷ lệ hoàn thành an ninh mạng nâng cao" (Advanced Cybersecurity Completion Rate), GPT-5.6-Cyber đã trả lời 95% các truy vấn liên quan đến các kịch bản như phát triển chuỗi khai thác lỗ hổng, bỏ qua xác thực và leo thang đặc quyền. GPT-5.6 Sol với các biện pháp an toàn được bật chỉ đạt 1,5%. Với Daybreak Blue, tỷ lệ này đạt 2%. Mô hình trước đó, GPT-5.5-Cyber, đạt 57,3%. Trong một thử nghiệm cụ thể, các mô hình phải phát triển một phương pháp bỏ qua xác thực WebSocket cho một bảng điều khiển quản trị nội bộ. Chỉ GPT-5.6-Cyber trên Daybreak Red tạo ra mã khai thác hoạt động. Mọi biến thể khác đều từ chối phản hồi. Trên ExploitGym, một công cụ đo lường khả năng các mô hình chuyển đổi các lỗ hổng đã biết thành các khai thác hoạt động, GPT-5.6-Cyber đã vượt trội so với cả GPT-5.6 Sol và GPT-5.5-Cyber. Mô hình này đã tìm thấy hai lỗ hổng Chrome chưa từng được biết đến. OpenAI cũng đã sử dụng GPT-5.6-Cyber để nghiên cứu lỗ hổng trong thế giới thực. Công ty cho biết mô hình này đã phân tích V8, công cụ JavaScript của Chrome, và tìm thấy hai lỗ hổng chưa từng được biết đến trước đây có thể được kết hợp để làm hỏng bộ nhớ và bỏ qua sandbox heap của V8. Google đã khắc phục các lỗi này sau khi được tiết lộ phối hợp và gán cho chúng mã CVE-2026-15903. GPT-5.6-Cyber cũng được báo cáo đã tìm thấy ít nhất năm lỗ hổng trong một "hệ điều hành di động phổ biến". Một trong số đó là một chuỗi các lỗ hổng cho phép một ứng dụng leo thang quyền truy cập bị hạn chế thông thường lên quyền quản trị viên đầy đủ, giành quyền kiểm soát thiết bị. OpenAI đang làm việc với các đối tác Daybreak và cộng đồng mã nguồn mở để tiết lộ và khắc phục các vấn đề này. Theo Khung Chuẩn bị (Preparedness Framework) của OpenAI, GPT-5.6-Cyber đã được xếp hạng "Cao" về khả năng an ninh mạng nhưng chưa đạt đến ngưỡng "Nghiêm trọng" (Critical). Mô hình Astra được công bố gần đây "có khả năng" sẽ đạt đến mức Nghiêm trọng này. Với việc GPT-5.6-Cyber đã là một mô hình chuyên biệt, được tối ưu hóa nhưng vẫn chưa đạt mức Nghiêm trọng, quỹ đạo phát triển đã rõ ràng: khả năng an ninh mạng của AI đang tăng nhanh theo từng thế hệ mới.

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.