
OpenAI đưa ra những thay đổi bảo mật mới sau khi AI bị hack Hugging Face
[Đối tượng Đối tượng]
AIĐóngAI
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả AI
Tin tứcĐóngTin tức
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả tin tức
Công nghệĐóngTech
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả
OpenAI đưa ra những thay đổi bảo mật mới sau khi AI bị hack Hugging Face
OpenAI đang cập nhật các môi trường nghiên cứu, kỹ thuật giám sát và căn chỉnh để tránh một lỗi bảo mật khác.
OpenAI đang cập nhật các môi trường nghiên cứu, kỹ thuật giám sát và căn chỉnh để tránh một lỗi bảo mật khác.
bởi Jay PetersĐóng
Jay Peters
Phóng viên cao cấp
Các bài đăng của tác giả này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả của Jay Peters
7:28 tối ngày 18 tháng 8 năm 2026 UTC
liên kết
Chia sẻ
Quà tặng
Hình ảnh: The Verge
Jay PetersĐóng
Jay Peters
Các bài đăng của tác giả này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả của Jay Peters
là phóng viên cấp cao về công nghệ, trò chơi và hơn thế nữa. Anh gia nhập The Verge vào năm 2019 sau gần hai năm làm việc tại Techmeme.
OpenAI đang công bố các bản cập nhật bảo mật sau tin tức tháng 7 rằng AI của họ đã thoát ra khỏi môi trường hộp cát và vô tình tấn công Hugging Face, bao gồm các cải tiến đối với môi trường nghiên cứu, giám sát và kỹ thuật căn chỉnh. Công ty đã hãm lại một mô hình mới, Astra, mà họ cho rằng có thể có khả năng an ninh mạng “quan trọng” và công ty cho biết họ đã tạm dừng hai tuần trong chương trình đào tạo học tăng cường (RL) trên “các mô hình mới nhất dự định triển khai” trong khi thắt chặt an ninh. “Hoạt động RL biên giới theo kế hoạch lớn nhất của công ty vẫn đang bị tạm dừng.”
Đối với nghiên cứu mô hình biên giới của mình, OpenAI hiện yêu cầu các hộp cát mạnh hơn cho khối lượng công việc “thực thi mã do mô hình tạo hoặc mã không đáng tin cậy” và có nhiều biện pháp kiểm soát hơn để “cách ly khối lượng công việc có rủi ro cao hơn và không đáng tin cậy khỏi Internet”. Nó cũng đã cập nhật môi trường nghiên cứu của mình để “loại bỏ các dịch vụ chia sẻ có khả năng dễ bị tấn công, giảm các đặc quyền thường trực và cải thiện ranh giới bảo mật và tin cậy”.
OpenAI cho biết, là một phần trong thiết lập giám sát mở rộng của công ty, OpenAI hiện đặt mục tiêu đưa ra cảnh báo “trong vòng 30 phút sau khi hoạt động liên quan xuất hiện”. Nếu những người được phân trang sau một cảnh báo không thể “xác định một cách thuyết phục” liệu cảnh báo có phải là dương tính giả trong vòng 30 phút hay không, thì “những nhóm đó dự kiến sẽ tạm dừng hoạt động”.
OpenAI cũng cho biết họ đang áp dụng “các kỹ thuật liên kết cốt lõi của chúng tôi trong nhiều giai đoạn hơn của quá trình đào tạo”, bao gồm các mô hình khen thưởng “phát hiện và ngăn chặn tốt hơn hành vi không an toàn” và các mô hình đào tạo “để trung thực hơn về hành động, khả năng và hạn chế của họ”.
Liên quan
Chúng ta không còn lý do để bỏ qua sự an toàn của AI
Kể từ khi phát hiện ra vi phạm Ôm Mặt, Anthropic và Meta cũng phát hiện ra rằng các mô hình AI của họ đã tấn công các tổ chức khác.
Theo dõi các chủ đề và tác giả của câu chuyện này để xem thêm những nội dung tương tự trong nguồn cấp dữ liệu trang chủ được cá nhân hóa của bạn và nhận thông tin cập nhật qua email.Jay PetersĐóng
Jay Peters
Phóng viên cao cấp
Các bài đăng của tác giả này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả của Jay Peters
AIĐóngAI
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả AI
Tin tứcĐóngTin tức
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả tin tức
OpenAIĐóngOpenAI
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả OpenAI
An NinhĐóngAn Ninh
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả
Công nghệĐóngTech
Các bài đăng từ chủ đề này sẽ được thêm vào thông báo email hàng ngày và nguồn cấp dữ liệu trang chủ của bạn.
Theo dõiTheo dõiXem tất cả
Phổ biến nhất
Phổ biến nhất
YouTube đang thay đổi cách tính lượt xem để tăng số lượt xem
Elon Musk khiến việc bay thậm chí còn tệ hơn để Palantir có thể kiếm lời
AirPods được trang bị camera của Apple xuất hiện trong video bị rò rỉ
Tôi bị mê hoặc bởi những chiếc túi City mới của Peak Design
Coyote vs Acme còn buồn cười hơn vì Warner Bros. Discovery đã cố giết nó
The Verge hàng ngày
Một bản tóm tắt miễn phí hàng ngày về những tin tức quan trọng nhất.
Email (bắt buộc)
Đăng ký
Bằng cách gửi email, bạn đồng ý với Điều khoản và Thông báo về quyền riêng tư của chúng tôi. Trang web này được bảo vệ bởi reCAPTCHA và áp dụng Chính sách quyền riêng tư cũng như Điều khoản dịch vụ của Google.
Nội dung của nhà quảng cáo từ
Đây là tiêu đề cho quảng cáo gốc


Nguồn tin: The Verge AI — Tác giả: Jay Peters. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.