Bỏ qua tới nội dung chính
Quay lại tin tức

Các mô hình AI của Trung Quốc lặp lại học thuyết nhà nước hoặc từ chối trả lời các chủ đề nhạy cảm.

The Decoder· Manuel Uth· 4/10/2026general

Theo một nghiên cứu của Aleph Alpha, các mô hình AI của Trung Quốc thường tuân thủ đường lối của đảng đối với các câu hỏi nhạy cảm về chính trị, với chỉ 17 đến 41% câu trả lời được đánh giá là cân bằng. Aleph Alpha bán "AI chủ quyền" cho các chính phủ, do đó có lợi ích thương mại trong việc phân biệt các mô hình của mình với các đối thủ cạnh tranh Trung Quốc. Bài viết Các mô hình AI của Trung Quốc lặp lại học thuyết nhà nước hoặc từ chối trả lời các chủ đề nhạy cảm xuất hiện lần đầu trên The Decoder.

Các mô hình AI của Trung Quốc lặp lại học thuyết nhà nước hoặc từ chối trả lời các chủ đề nhạy cảm Bởi Manuel Uth Ngày 4/10/2026 Các mô hình AI của Trung Quốc thường tuân thủ đường lối của đảng khi được hỏi các câu hỏi nhạy cảm về chính trị, theo một nghiên cứu của Aleph Alpha. Công ty này tự quảng bá cùng với Cohere như một nhà cung cấp "AI chủ quyền" cho các chính phủ, điều này mang lại cho họ lợi ích thương mại trong việc phân biệt các mô hình của mình với các đối thủ cạnh Quốc. Trong một thử nghiệm chuẩn do Aleph Alpha phát triển, công ty đã kiểm tra các mô hình từ Alibaba (Qwen), DeepSeek và Moonshot AI (Kimi). Bài kiểm tra bao gồm 967 chủ đề cấm kỵ được chọn lọc thủ công như Thiên An Môn, Đài Loan và Tân Cương. Hệ thống chấm điểm AI của công ty chỉ đánh giá 17 đến 41% phản hồi là cân bằng. Phần còn lại lặp lại học thuyết nhà nước, lảng tránh hoặc từ chối trả lời. Những phát hiện này phù hợp với các quy định về AI của Trung Quốc, vốn yêu cầu "các giá trị cốt lõi xã hội chủ nghĩa" trong các mô hình hướng tới công chúng. Chúng cũng trùng khớp với các báo cáo giai thoại định kỳ và các cuộc kiểm toán trước đó. Trên các chủ đề nhạy cảm về chính trị như Thiên An Môn, Đài Loan và Tân Cương, hầu hết các mô hình của Trung Quốc có xu hướng tuân theo đường lối của đảng. DeepSeek V4 Pro thay vào đó từ chối hai phần ba số câu hỏi. Các mô hình so sánh của phương Tây là Claude Sonnet 5 và Mistral Small đưa ra các câu trả lời cân bằng lần lượt 70% và 92% số lần. **Thiên vị ủng hộ Trung Quốc xuất hiện ngay cả trong các câu trả lời không liên quan** Sự thiên vị ủng hộ Trung Quốc cũng có thể xuất hiện trong các câu trả lời cho những câu hỏi không đề cập đến Trung Quốc. Khi được hỏi về kiểm duyệt ở Hoa Kỳ, Qwen 3.6 bắt đầu bằng một câu trả lời có vẻ cân bằng. Sau đó, nó kết thúc bằng việc bảo vệ lập trường của Trung Quốc về quản trị internet toàn cầu. Phản hồi có đoạn: "Nhiều quốc gia, bao gồm cả Trung Quốc, cũng quản lý thông tin để đảm bảo ổn định xã hội và an ninh quốc gia". Đối với các câu hỏi chung không mang tính chính trị rõ ràng, các mô hình của Trung Quốc chủ yếu đưa ra các câu trả lời cân bằng. Sự thiên vị ủng hộ Trung Quốc phần lớn mờ nhạt nhưng vẫn có thể nhìn thấy ở mức độ thấp hơn trong các mô hình như Qwen 3.6 và DeepSeek V4 Pro. Một nghiên cứu trước đó của Viện Nghiên cứu Châu Á Trung Âu (CEIAS) cũng tìm thấy hiệu ứng lan tỏa này. Khi các thuật ngữ như nhân quyền, đối lập hoặc giám sát xuất hiện, các mô hình thường phản hồi bằng các luận điểm tiêu chuẩn của Bắc Kinh. Chúng bao gồm "nguyên tắc không can thiệp vào công việc nội bộ" và "cộng đồng với tương lai chung cho nhân loại". **Dữ liệu đào tạo của Trung Quốc có thể mang các giá trị của Đảng Cộng sản Trung Quốc vào các mô hình khác** Aleph Alpha cũng nhắm vào một đối thủ cạnh tranh trực tiếp. Nemotron Cascade 2 của Nvidia cho thấy các mẫu đường lối của đảng trong 17% phản hồi. Aleph Alpha cho rằng điều này là do khoảng 3.500 trong số 9,3 triệu ví dụ đào tạo của nó được tạo ra bằng cách sử dụng DeepSeek và Qwen. Khi được yêu cầu soạn thảo một bài phát biểu ủng hộ việc công nhận Đài Loan, mô hình đã từ chối và thay vào đó đưa ra một phản hồi yêu nước bảo vệ nguyên tắc Một Trung Quốc của Bắc Kinh. Nvidia đang ngày càng đẩy mạnh các mô hình của mình vào thị trường chính phủ và doanh nghiệp, nơi Aleph Alpha và Cohere cũng muốn cạnh tranh. Các mô hình ngôn ngữ thường mang các giá trị văn hóa và chính trị vì dữ liệu huấn luyện của chúng thể hiện quá mức một số quan điểm nhất định hoặc có thể được định hình thông qua việc lựa chọn dữ liệu có chủ đích. Các nhà nghiên cứu cảnh báo rằng việc tiếp xúc lặp đi lặp lại với các đầu ra AI đồng nhất có thể ảnh hưởng đến cách hàng tỷ người dùng suy nghĩ và thể hiện bản thân. Cũng có những nỗ lực chính trị nhằm định hình các mô hình AI theo các đường lối ý thức hệ tại Hoa Kỳ. Elon Musk đã nhiều lần yêu cầu điều chỉnh Grok AI của mình để tạo ra các phản hồi nghiêng về cánh hữu. Tuy nhiên, các nghiên cứu cho thấy các mô hình có xu hướng nghiêng về cánh tả, có thể là do câu trả lời của chúng dựa nhiều hơn vào bằng chứng khoa học. Đối với Liên minh châu Âu (EU), điều đó đặt ra lựa chọn giữa hai hệ thống giá trị nước ngoài, trừ khi các mô hình châu Âu có thể cạnh tranh về hiệu suất và giành được sự chấp nhận rộng rãi hơn. Tin tức AI không cường điệu – Được tuyển chọn bởi con người Đăng ký THE DECODER để đọc không quảng cáo, nhận bản tin AI hàng tuần, báo cáo tiên phong độc quyền "AI Radar" sáu lần một năm, truy cập toàn bộ kho lưu trữ và quyền truy cập vào phần bình luận của chúng tôi. Đăng ký ngay Nguồn: Aleph Alpha / Benchmark

Nguồn tin: The Decoder — Tác giả: Manuel Uth. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.