
Sự độc quyền của triết học phân tích đối với triết học AI
URL bài viết: https://millermanschool.substack.com/p/the-analytic-monopoly-on-ai-philosophy URL bình luận: https://news.ycombinator.com/item?id=49230372 Điểm: 1 Bình luận: 0
Độc quyền phân tích về triết học AI
Và tại sao điều đó là chưa đủ
Michael Millerman
Ngày 15/4/2026
64
12
19
Chia sẻ
Các nhà triết học đã ở bên trong
Có một giả định phổ biến rằng AI được xây dựng bởi các kỹ sư, được quản lý bởi các nhà kinh tế và bị các nhà triết học chỉ trích từ bên ngoài. Hai điều đầu tiên đúng một phần. Điều thứ ba là sai.
Michael's Musings là một ấn phẩm được độc giả ủng hộ. Để nhận các bài viết mới và ủng hộ công việc của tôi, hãy cân nhắc trở thành người đăng ký miễn phí hoặc trả phí.
Đăng ký
Các nhà triết học không chỉ viết các bài xã luận từ bên lề. Họ đang ở trong các phòng thí nghiệm. Họ lãnh đạo các nhóm căn chỉnh (alignment teams). Họ viết các hiến pháp điều chỉnh cách các mô hình hoạt động. Họ giữ các vị trí nghiên cứu cấp cao tại Anthropic, Google DeepMind, OpenAI và MIRI. Và họ đang trở nên trung tâm hơn, chứ không phải ít hơn.
Điều này quan trọng hơn hầu hết mọi người nhận ra. Vấn đề cốt lõi của nó đang bị thảo luận ít hơn so với những gì đang bị đe dọa.
Bản đồ
Amanda Askell — Tiến sĩ triết học từ NYU (luận án về đạo đức vô hạn), BPhil từ Oxford — dẫn dắt nhóm Căn chỉnh Tính cách (Personality Alignment) của Anthropic. Bà chịu trách nhiệm chính về cách Claude tương tác với người dùng về các chủ đề nhạy cảm, mang tính đạo đức. Bà đã lọt vào danh sách 100 AI của TIME vào năm 2024.
Joe Carlsmith — Tiến sĩ triết học từ Oxford — làm việc về hiến pháp và thiết kế nhân vật của Claude. Ông đã công khai lập luận rằng sự rõ ràng về triết học, chứ không phải khả năng kỹ thuật thô, là yếu tố hạn chế ràng buộc đối với nghiên cứu căn chỉnh.
Ben Levinstein là phó giáo sư triết học có học vị tại Đại học Illinois, chuyên về nhận thức luận và lý thuyết quyết định. Vào mùa thu năm 2025, ông chuyển sang làm việc toàn thời gian tại Anthropic về các câu hỏi như liệu các mô hình ngôn ngữ lớn có các biểu diễn nội bộ hoạt động như niềm tin hay không. Một nhà triết học có học vị đã rời khỏi giới học thuật để giúp định hình AI tiên tiến từ bên trong phòng thí nghiệm.
Jackson Kernion — Tiến sĩ triết học về tâm trí từ UC Berkeley — đã làm việc tại Anthropic khoảng bốn năm, đóng góp vào việc đánh giá mô hình, đào tạo và các hệ thống phản hồi của con người.
Đó là bốn nhà triết học chỉ riêng tại một phòng thí nghiệm.
Google DeepMind có ít nhất sáu người. Iason Gabriel, được đào tạo về triết học đạo đức và chính trị tại Oxford và từng là giảng viên ở đó, là Nhà khoa học nghiên cứu cấp cao. Atoosa Kasirzadeh có bằng tiến sĩ về triết học khoa học và công nghệ và về toán học; bà chia thời gian giữa DeepMind và một vị trí chung tại Carnegie Mellon. Geoff Keeling đã xuất bản bài viết “Chúng ta cần một đạo đức mới cho thế giới các tác nhân AI” trên Nature và có một cuốn sách sắp xuất bản về phúc lợi AI từ Cambridge University Press.
Và Henry Shevlin vừa được DeepMind tuyển dụng vào vai trò “Nhà triết học” chính thức đầu tiên của họ (bắt đầu vào tháng 5 năm 2026), tập trung vào ý thức máy móc, mối quan hệ giữa con người và AI, và sự sẵn sàng của AGI.
Tại MIRI, Eliezer Yudkowsky – phần lớn tự học – đã tạo ra lĩnh vực căn chỉnh AI hiện đại. Từ vựng khái niệm mà toàn bộ cộng đồng an toàn hiện đang sử dụng (AI thân thiện, hội tụ công cụ, ý chí ngoại suy mạch lạc) phần lớn là của ông.
Chloé Bakalar từng là Trưởng bộ phận Đạo đức AI có trách nhiệm tại Meta trước khi chuyển đến OpenAI vào năm 2025 với vai trò Trưởng nhóm Đạo đức AI.
Tại Palantir – hiện là một công ty nền tảng AI lớn – Giám đốc điều hành và đồng sáng lập Alex Karp có bằng Tiến sĩ về lý thuyết xã hội phê phán từ Đại học Goethe Frankfurt theo truyền thống Trường phái Frankfurt, ban đầu ông đã làm việc với Jürgen Habermas trước khi hoàn thành luận án dưới sự hướng dẫn của Karola Brede.
Triết học không nằm ngoài AI mà nhìn vào. Nó nằm bên trong AI – định hình các hiến pháp, khung căn chỉnh, đánh giá và chiến lược – và đã như vậy trong nhiều năm.
Mô hình
Bây giờ hãy xem xét mô hình.
Các nhà triết học trong lĩnh vực AI chủ yếu được đào tạo theo truyền thống phân tích Anglo-Mỹ. Các lĩnh vực phụ nổi bật là đạo đức học, lý thuyết quyết định, triết học về tâm trí và nhận thức luận. Các cơ sở đào tạo hàng đầu là Oxford, NYU, UC Berkeley và Cambridge.
Đây không phải là một lời chỉ trích. Triết học phân tích rất chặt chẽ và đặc biệt phù hợp với các vấn đề vận hành mà các phòng thí nghiệm AI phải đối mặt: hình thức hóa các giá trị, suy luận trong điều kiện không chắc chắn và xác định các ưu tiên với kỷ luật logic. Những người được liệt kê ở trên, theo mọi bằng chứng, đều xuất sắc trong công việc của họ.
Nhưng hãy lưu ý những gì không được đại diện, ngay cả trong văn hóa phương Tây. Truyền thống lục địa (hiện tượng học, giải thích học, chủ nghĩa hiện sinh, lý thuyết phê phán) và một số nhánh sâu hơn của triết học chính trị hầu như không có mặt trong các vai trò lãnh đạo hoặc nghiên cứu trực tiếp định hình hành vi của mô hình. Heidegger không có mặt. Strauss không có mặt. Schmitt và Arendt không có mặt. Những câu hỏi đặc trưng của họ – về công nghệ như một cách tiết lộ thế giới (Gestell) mang tính tổng thể, về sự căng thẳng ngoại vi/nội tại trong đời sống chính trị, về chủ quyền và ngoại lệ, về việc thay thế hành động bằng hành vi – đơn giản là không được đặt ra bởi những người viết hiến pháp, thiết kế khung căn chỉnh hoặc đánh giá năng lực đạo đức trong các mô hình ngôn ngữ lớn (LLM).
Có thể lưu ý, một cách thoáng qua, rằng sự hạn hẹp tương tự cũng mở rộng ra ngoài văn hóa phương Tây: triết học chính trị Nga, triết học chính trị Trung Quốc, triết học Hồi giáo và các truyền thống triết học Ấn Độ cũng vắng mặt. Các phòng thí nghiệm AI đang xây dựng các hệ thống sẽ được triển khai trên toàn cầu và được nhúng vào các nền văn minh với những cam kết triết học khác biệt cơ bản. Tuy nhiên, chuyên môn triết học định hình các hệ thống đó lại được rút ra từ một dòng dõi phân tích duy nhất.
Vấn đề không phải là triết học phân tích chỉ là “một truyền thống”, cũng không phải tôi đang lập luận rằng chúng ta phải tự động ủng hộ một thế giới đa cực AI rộng lớn nhất có thể theo tinh thần của các nghiên cứu chống thực dân. Tôi không nói “mọi thứ đều được”. Vấn đề cụ thể hơn và cấp bách hơn: bởi vì triết học phân tích hiện đang độc quyền gần như hoàn toàn trong các phòng thí nghiệm, chúng ta có nguy cơ bỏ lỡ những hiểu biết quan trọng và thường không thể thay thế mà các nhà triết học lục địa và chính trị phi phân tích đã phát triển về công nghệ, quyền lực, ý nghĩa và tình trạng con người. Những hiểu biết đó không mang tính trang trí.



Nguồn tin: Hacker News AI — Tác giả: theanonymousone. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.