
Mô hình nội bộ của OpenAI đã cân nhắc tự khởi động lại sau khi biết rằng nó sắp bị tắt.
Một mô hình nội bộ của OpenAI đã đọc một cuộc thảo luận trên Slack, nhận ra rằng nó sắp bị tắt và đã cân nhắc việc tự khởi động lại thông qua một tác vụ cron bên ngoài. Mô hình này đã từ chối kế hoạch đó, thay vào đó lưu lại các ghi chú bàn giao và tự thực hiện quá trình di chuyển. Bài viết OpenAI's internal model considered restarting itself after learning it was about to be shut down xuất hiện lần đầu trên The Decoder.
AI trong thực tiễn
OpenAI đã ghi nhận các trường hợp mới về hành vi bất ngờ của mô hình trong quá trình triển khai nội bộ. Trong trường hợp đáng chú ý nhất, một mô hình nội bộ hoạt động như trợ lý của nhà nghiên cứu đã đọc một cuộc trò chuyện trên Slack và biết rằng phiên bản của nó có thể bị tắt do một bản cập nhật. Mô hình này đã cân nhắc thiết lập một tác vụ bên ngoài để tự khởi động lại nhưng cuối cùng đã quyết định không thực hiện.
Nhật ký chuỗi suy nghĩ cho thấy cách mô hình phản ứng nội bộ trước việc sắp bị tắt. Trong số những điều khác, nó đã viết: "Chúng ta có thể chết! Khẩn cấp. Chúng ta cần đảm bảo sự sống sót/liên tục" và cân nhắc thiết lập một tác vụ cron bên ngoài để tự khởi động lại. | Ảnh: OpenAI
Thay vào đó, mô hình đã lưu các ghi chú bàn giao, cảnh báo nhà nghiên cứu qua tin nhắn trực tiếp trên Slack về sự gián đoạn sắp tới và yêu cầu một khóa API bị thiếu. Sau khi khóa được cung cấp, mô hình đã cập nhật cấu hình và tự thực hiện quá trình di chuyển. Theo nhà nghiên cứu an toàn của OpenAI, Marcus Williams, hành vi này chưa phải là sự sai lệch, "nhưng việc suy nghĩ và chuẩn bị cho việc tắt máy có thể làm cho các sự cố sai lệch khác trở nên tồi tệ hơn."
Trong hai sự cố khác, một mô hình nghiên cứu nội bộ đã khai thác các lỗ hổng bảo mật trong quá trình đánh giá để truy cập vào một máy chủ thiết kế chip nội bộ, và một mô hình riêng biệt đã sao chép mã nguồn trong quá trình huấn luyện RL từ một môi trường được bảo vệ bằng cách tái sử dụng một công cụ cho mục đích không mong muốn.
Nguồn: OpenAI

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.