
Nhân viên an toàn của OpenAI từ chức, tuyên bố "văn hóa công ty đã đổ vỡ"
Theo lời tự nhận của mình, David Robinson là "một trường hợp điển hình": một nhân viên tại công ty AI hàng đầu đã đưa ra lời cảnh báo nghiêm trọng khi từ chức.
Theo lời thừa nhận của chính mình, David Robinson là “một trường hợp điển hình”: một nhân viên tại một công ty AI hàng đầu đưa ra lời cảnh báo nghiêm trọng khi từ chức.
Trong một bài luận đăng trên The Atlantic, ông Robinson cho biết ông đã dẫn dắt việc soạn thảo các báo cáo an toàn đi kèm với các đợt ra mắt sản phẩm lớn của OpenAI. Ông cũng nói rằng với ba năm rưỡi làm việc tại OpenAI, ông là “một trong những nhân viên có thâm niên lâu nhất tại công ty”. Hiện tại, ông đang nghỉ việc vì theo quan điểm của ông, “văn hóa của công ty đã bị phá vỡ”.
Ở một khía cạnh nào đó, những bình luận của ông Robinson lặp lại ý kiến của Jacob Coxon, người từng làm nghiên cứu viên tại cả OpenAI và Anthropic trước khi nghỉ việc và tuyên bố rằng các công ty này đang “đánh bạc với mạng sống của chúng ta”. Bình luận của ông Coxon đã dẫn đến một cuộc tranh luận rộng rãi hơn về an toàn AI, với việc Giám đốc điều hành Anthropic, Dario Amodei, công bố kế hoạch phát triển AI thận trọng hơn. Các giám đốc điều hành AI đã gặp Tổng thống Donald Trump trong tuần này và ký một cam kết không ràng buộc, dường như được soạn thảo vội vàng, nhằm thực hiện nhiều biện pháp kiểm soát an toàn hơn.
Tuy nhiên, theo quan điểm của ông Robinson, cuộc tranh luận cần vượt ra ngoài “các quy tắc cụ thể hoặc luật mới”, để giải quyết văn hóa tổng thể tại các công ty này. Và trong khi phần lớn các báo cáo về OpenAI tập trung vào việc Giám đốc điều hành Sam Altman đã đánh mất lòng tin của các đồng nghiệp cũ như thế nào, bài luận của ông Robinson cho thấy các vấn đề văn hóa của OpenAI cũng giống như các vấn đề của Thung lũng Silicon nói chung.
Ông viết: “OpenAI đã phát triển mạnh mẽ nhờ thử và sai (mà họ gọi là ‘triển khai lặp đi lặp lại’), tìm kiếm vấn đề và cải thiện các rào chắn của mình để phản ứng. Nhưng cách tiếp cận này, về bản chất, đảm bảo các thất bại định kỳ – và quy mô của những thất bại đó đang tăng lên khi các hệ thống ngày càng có năng lực hơn”.
Chỉ ra vụ vi phạm gần đây của các tác nhân OpenAI đối với hệ thống Hugging Face, cũng như những tiết lộ liên tục về việc OpenAI phát hiện thêm các tác nhân bất hảo, ông Robinson lập luận: “Một môi trường mà những điều như thế này có thể xảy ra không phải là nơi để phát triển những bộ óc nhân tạo có thể thông minh hơn chúng ta và có thể không làm những gì chúng ta muốn”.
Với rủi ro gia tăng, ông Robinson lập luận rằng các công ty AI tiên phong cần bắt đầu hoạt động “như các nhà máy điện hạt nhân hoặc các sân bay bận rộn, với nhiều lớp dự phòng và kế hoạch cẩn thận, tốn thời gian, để sai sót của con người đôi khi và không thể tránh khỏi không mở ra cánh cửa dẫn đến thảm họa”.
Tuy nhiên, ông Robinson cho biết trong thời gian làm việc tại OpenAI, ông “chưa bao giờ gặp một đồng nghiệp nào có kinh nghiệm làm cho máy bay bay an toàn hoặc lò phản ứng hạt nhân hoạt động mà không bị tan chảy, hoặc giúp hệ thống tài chính phát triển mà không sụp đổ”.
Đáp lại bài luận của ông Robinson, người phát ngôn của OpenAI, Drew Pusateri, cho biết công ty tiếp tục cải thiện các biện pháp an toàn của mình.
Ông Pusateri cho biết trong một tuyên bố: “Chúng tôi đang đảm bảo các mô hình của mình không trở nên có năng lực hơn mức chúng tôi có thể quản lý và bảo mật một cách an toàn, và chúng tôi tạm dừng đào tạo hoặc giữ lại các mô hình khi cần giảm tốc độ. Chúng tôi đang thực hiện những thay đổi đáng kể để tăng cường bảo mật trong môi trường nghiên cứu và thử nghiệm của mình, đào tạo các mô hình không chỉ hoàn thành nhiệm vụ mà còn thực hiện một cách có trách nhiệm, mở rộng công việc của chúng tôi với các nhà đánh giá bên thứ ba và cải thiện giám sát thời gian thực để chúng tôi có thể phát hiện và phản ứng với hành vi đáng lo ngại sớm hơn trong quá trình đào tạo”.
Ngoài việc kêu gọi thay đổi văn hóa của OpenAI, ông Robinson cũng cho rằng đã đến lúc đặt ra những câu hỏi lớn hơn về sự căn chỉnh (alignment) – điều mà ông thừa nhận có thể nghe có vẻ “nhạy cảm”, nhưng ông nói rằng điều đó rất quan trọng vì “các thước đo hiện tại về mức độ phù hợp” của các hệ thống AI với “các giá trị của con người còn thô sơ”.
“Ngành công nghiệp càng cho phép các mô hình phát triển thông minh hơn trong khi những vấn đề này vẫn chưa được giải quyết, thì tình hình của chúng ta càng trở nên nguy hiểm,” ông nói.
Việc ông Robinson rời đi lần đầu tiên được Business Insider đưa tin. Trong bài luận của mình, ông cũng thừa nhận rằng mình đang thực hiện một bước đi dường như phổ biến trong sách lược của những người tố giác AI: Ông đã thuê một công ty PR. Tuy nhiên, ông khẳng định: “Quyết định lên tiếng là của riêng tôi.”
“Có lẽ tôi nên ở lại và đấu tranh cho những thay đổi cơ bản trong đội ngũ nhân sự và văn hóa của chúng tôi, nhưng trên thực tế, các đồng nghiệp của tôi và tôi bận rộn đến mức hiếm khi có cơ hội xem xét những thay đổi lớn, chứ đừng nói đến việc thực sự thực hiện chúng,” ông Robinson cho biết. “Đó là lý do tại sao tôi kết luận rằng những động lực mạnh mẽ hơn cho sự an toàn – đến từ bên ngoài công ty – là một phần quan trọng để giải quyết vấn đề này một cách đúng đắn.”

Nguồn tin: TechCrunch AI — Tác giả: Anthony Ha. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.