
Cộng đồng an toàn AI (trí tuệ nhân tạo) không may đang gây hại nhiều hơn là có lợi.
URL bài viết: https://twitter.com/knowerofmarkets/status/2105330652732125602 URL bình luận: https://news.ycombinator.com/item?id=49960418 Điểm: 1 Số bình luận: 1
Cộng đồng An toàn AI (AI Safety) đáng tiếc đang gây hại nhiều hơn là có lợi.
Mới hôm qua, Palisade Research đã công bố một loạt phỏng vấn với 22 nhân viên hiện tại hoặc cựu nhân viên của các phòng thí nghiệm AI tiên tiến. Họ được hỏi về quan điểm của mình về chủ đề "ngày tận thế AI" và các kịch bản liên quan như sự tuyệt chủng của loài người, hoặc điều gì thực sự cần thiết để một máy tính có thể tiêu diệt tất cả chúng ta.
Các nhân viên hiện tại và cựu nhân viên chia sẻ ý kiến của họ trong các đoạn phỏng vấn chất lượng cao này, nói rằng "sự tuyệt chủng của loài người là một xác suất 50/50" hoặc "con người đang cản đường các mô hình này". Tôi cho rằng đây là một nỗ lực nhằm nâng cao mối lo ngại về việc tiếp tục phát triển AI mà họ tin rằng đang đe dọa nhân loại.
Điều này có thể đã gây sốc, hoặc có khả năng "gây bão mạng" trước ngày 8/9, ngày Jacob Coxon phá vỡ sự im lặng về lý do anh chọn rời bỏ vai trò của mình tại Anthropic. Kể từ sự kiện mang tính văn hóa này, đã có nhiều cuộc thảo luận đáng kể về việc các phòng thí nghiệm có thể muốn được quốc hữu hóa (tôi tin điều này là sai), một loạt các cuộc tranh luận chồng chéo về sự cố OAI-HuggingFace cộng với các nền văn minh tác nhân, cũng như các cuộc thảo luận liên tục về vai trò của Chính phủ Hoa Kỳ trong việc phát triển siêu trí tuệ hoặc trí tuệ nhân tạo có tri giác trong tương lai.
Nói một cách đơn giản hơn, tuyên truyền gần đây của Palisade xuất hiện vào thời điểm mà các quan điểm bổ sung về sự cần thiết phải làm chậm quá trình phát triển AI là không cần thiết, đặc biệt khi những quan điểm này có vẻ khá có hại cho toàn bộ ngành công nghiệp.
Coxon cho biết anh rời Anthropic vì cuộc chạy đua của họ hướng tới siêu trí tuệ tự cải thiện đang diễn ra quá nhanh và tuyên bố họ đang "đánh cược với cuộc sống của chúng ta". Bài đăng của Coxon đã lan truyền rộng rãi, đạt hơn 150 triệu lượt xem, thậm chí còn xuất hiện trên các nền tảng thân thiện với người dùng phổ thông hơn như TikTok và YouTube, cũng như dẫn đến một loạt các lần xuất hiện trên truyền thông của Jacob Coxon.
Những cảnh báo của Coxon được đưa ra sau bức thư ngỏ "Pacing the Frontier" (Giữ nhịp biên giới) vào tháng 7 năm 2026, do 1.386 nhân viên đang làm việc tại các phòng thí nghiệm AI tiên tiến ký tên. Bức thư này kêu gọi các phòng thí nghiệm giảm tốc độ và phối hợp trong việc phát triển các hệ thống AI tiên tiến, tránh để chúng trở nên quá mạnh mẽ và gây nguy hiểm cho nhân loại.
Bài đăng của Coxon và bức thư "Pacing" đã góp phần lớn đưa các chủ đề về an toàn và căn chỉnh AI vào diễn ngôn công chúng ngoài nền tảng X. Tuy nhiên, điều này cũng khiến việc phát triển AI trở thành một vấn đề mang tính phe phái, chia rẽ thành hai nhóm: một bên muốn tiếp tục phát triển AI và một bên muốn tạm dừng AI cho đến khi có sự hiểu biết tốt hơn về các trí tuệ "ngoài hành tinh" này.
Mặc dù nhóm thứ hai xuất phát từ thiện chí (theo giả định), họ không nhận thức được rằng những lời kêu gọi làm chậm hoặc thậm chí tạm dừng phát triển AI của họ đã vô tình tiếp tay cho những người bi quan về AI trong Quốc hội và Thượng viện, cũng như hàng chục triệu người Mỹ bình thường ghét bỏ mọi thứ liên quan đến AI.
Khi một người bình thường thấy những lời kêu gọi từ "nhân viên phòng thí nghiệm AI tiên tiến hiện tại" nói rằng sự tuyệt chủng của loài người là một xác suất 50/50, điều này không giúp họ chuyển hướng đến một trang web như LessWrong để đọc về căn chỉnh AI hoặc tham gia vào các cuộc thảo luận tích cực với một bài luận phức tạp như "AI 2040: Kế hoạch A".
Thay vào đó, họ thấy những nhà nghiên cứu AI này – những người mà họ được biết là kiếm hàng triệu đô la và sẽ kiếm hàng chục triệu đô la hoặc hơn sau khi IPO – đang la hét về những mối nguy hiểm của AI trong khi vẫn đại diện cho nhà tuyển dụng hiện tại của họ bằng tên và logo trên một trang web như Palisade. Họ nhìn thấy điều này và cảm thấy khinh miệt, hoặc thậm chí tức giận, hướng về một ngành công nghiệp quan trọng ngày càng liên quan đến an ninh quốc gia và tăng trưởng GDP liên tục tại Hoa Kỳ – một ngành công nghiệp quan trọng đến mức hơn một chục nhà lãnh đạo của nó đã gặp gỡ lãnh đạo quốc gia vào ngày hôm qua để đạt được thỏa thuận ký kết Hiệp định Siêu trí tuệ.
Việc một người đang làm việc trong lĩnh vực công nghệ và có thể bị xếp vào nhóm có liên quan đến AI có đủ tư cách để nói thay cho những người bình thường này hay không? Điều đó có thể, nhưng người viết cũng nói chuyện hàng ngày với những người không dùng X, không làm việc trong lĩnh vực công nghệ và không đọc các thẻ phát hành mô hình mới nhất từ OpenAI hay Anthropic.
Những người này không biết về những điều như Dự án Glasswing hay hiện tượng các phòng thí nghiệm AI mới nổi huy động được 250 triệu đô la vòng hạt giống, hoặc sự tồn tại của một tổ chức như METR có thể giúp đánh giá các mô hình AI trước khi phát hành. Hầu hết mọi người không sử dụng ChatGPT cho công việc hoặc các nhiệm vụ quan trọng khác, mà chỉ như một người bạn hoặc người quen.
Người bình thường ghét AI và muốn cấm nó không phải xuất phát từ việc đưa ra quyết định có thông tin, mà nhiều khả năng chỉ đơn giản là chán ngấy các chính trị gia và nhà công nghiệp muốn xây dựng trung tâm dữ liệu gần cộng đồng của họ. Họ được cho biết rằng công nghệ này là xấu, và vì vậy họ tin rằng nó là xấu. Nhiều người trong số họ thậm chí còn tin rằng các trung tâm dữ liệu không được sử dụng cho AI, mà là để giám sát hàng loạt, không hề hay biết về các dự án như Trung tâm Dữ liệu Utah được xây dựng với chi phí 1,5 tỷ đô la vào năm 2014, một trung tâm dữ liệu đã tồn tại mười hai năm và được sử dụng độc quyền bởi NSA và các tổ chức tình báo khác.
Việc có những người như Andy Masley viết các bài luận dài 5.000 từ để bác bỏ từng cáo buộc sai trái là không quan trọng, bởi vì không ai ngoài nhóm của chúng ta đọc những bài phê bình này. Do đó, khi nghe về một nhóm nhân viên phòng thí nghiệm AI khác đã cùng nhau lên tiếng chống lại những mối nguy hiểm của trí tuệ nhân tạo, đây không phải là một sự phát triển tích cực trong hành trình hiện tại của nhân loại. Thay vào đó, đây lại là một bằng chứng nữa sẽ được sử dụng để chống lại ngành công nghệ vào năm 2028, nhằm cấm hoàn toàn AI.
Tôi cho rằng những gì Palisade Research công bố ngày hôm qua là có hại và hoàn toàn không giúp thúc đẩy cuộc đối thoại về an toàn AI vào thời điểm hiện tại. Không có khả năng những người ủng hộ tăng tốc phát triển AI sẽ thấy điều này và thay đổi quan điểm của họ, hay một người bình thường sẽ thấy điều này mà không ngay lập tức cảm thấy cần phải chia sẻ nó trong các nhóm trò chuyện của họ để la ó nhiều hơn về AI và những "anh chàng công nghệ" nguy hiểm.
Tôi nhận thức được



Nguồn tin: Hacker News AI — Tác giả: gmays. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.