
Các phòng thí nghiệm AI không kiểm soát được hệ thống của chính họ
Không có công ty AI nào áp dụng đầy đủ các biện pháp kiểm soát cơ bản cho hệ thống AI nội bộ của mình. Bài báo Các phòng thí nghiệm AI không kiểm soát được hệ thống của chính họ xuất hiện đầu tiên trên The Decode.
Tin ngắn
Sao chép url vào clipboard
Chia sẻ bài viết này
Vào phần bình luận
Các phòng thí nghiệm AI không kiểm soát được hệ thống của chính họ
Maximilian Schreiner
Xem hồ sơ LinkedIn của Maximilian Schreiner
Ngày 19 tháng 8 năm 2026
Không có công ty AI nào áp dụng đầy đủ các biện pháp kiểm soát cơ bản cho hệ thống AI nội bộ của mình. Đó là điểm rút ra từ đánh giá đầu tiên của tổ chức phi lợi nhuận Guidelight. Nhóm đã xem xét Anthropic, OpenAI, Google, xAI và Meta, chỉ dựa trên các nguồn công khai như thẻ hệ thống, báo cáo an toàn và bài đăng trên blog.
Guidelight đã kiểm tra sáu phương pháp thực hành cơ bản. Chúng bao gồm ghi nhật ký hoạt động AI nội bộ, xác định các hành động rủi ro thông qua cơ chế xem xét, tắt khẩn cấp được gọi là "ngắt mạch" và lên kế hoạch ngăn chặn các mô hình sai lệch. Anthropic và OpenAI dẫn đầu với điểm C+, Google theo sau với điểm D+ và lộ trình chi tiết, trong khi xAI (D−) và Meta (F) đạt điểm kém nhất.
Không có công ty nào đáp ứng được các tiêu chuẩn an toàn do Guidelight đề xuất. | Hình ảnh: Đèn hướng dẫn
Các công ty làm tốt nhất việc phát hiện hành vi sai trái. Họ làm tệ nhất trong việc ngăn chặn và ngăn chặn. Guidelight là một tổ chức phi lợi nhuận độc lập được thành lập bởi cựu lãnh đạo an toàn OpenAI Page Hedley và Steven Adler.Ad
Quảng cáo
Tin tức AI không cường điệu – Được quản lý bởi con người
Đăng ký THE DECODER để đọc không có quảng cáo, bản tin AI hàng tuần, báo cáo biên giới "AI Radar" độc quyền của chúng tôi sáu lần một năm, quyền truy cập vào kho lưu trữ đầy đủ và quyền truy cập vào phần nhận xét của chúng tôi.
Đăng ký ngay bây giờ
Nguồn: Hướng dẫn
Hỏi về bài viết này…
Tìm kiếm

Nguồn tin: The Decoder — Tác giả: Maximilian Schreiner. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.