
Độc giả đánh giá truyện ngắn do AI tạo ra cao hơn truyện do con người viết, cho đến khi họ biết rằng một cỗ máy đã viết chúng.
Theo một nghiên cứu mới, người đọc không thể phân biệt truyện ngắn do ChatGPT tạo ra với truyện do con người viết. Hơn 2.500 người tham gia đã không đạt được kết quả tốt hơn mức ngẫu nhiên. Các văn bản do AI tạo ra thực tế được đánh giá cao hơn, nhưng điểm số giảm xuống ngay khi người tham gia biết rằng chúng được viết bởi máy. Bài viết "Người đọc đánh giá truyện ngắn do AI tạo ra cao hơn truyện do con người viết cho đến khi họ biết một cỗ máy đã viết chúng" lần đầu tiên xuất hiện trên The Decoder.
Cộng
Nghiên cứu AI
Sao chép URL vào khay nhớ tạm
Chia sẻ bài viết này
Đi đến phần bình luận
Độc giả đánh giá truyện ngắn do AI tạo ra cao hơn truyện do con người viết cho đến khi họ biết một cỗ máy đã viết chúng
Matthias Bastian
Xem hồ sơ LinkedIn của Matthias Bastian
Ngày 8/8/2026
Độc giả không thể phân biệt được truyện ngắn do ChatGPT tạo ra và truyện do con người viết. Họ thậm chí còn đánh giá các văn bản do AI tạo ra cao hơn, nhưng chỉ khi họ không biết một cỗ máy đã viết chúng.
Trong ba thí nghiệm với tổng số hơn 2.500 người tham gia, các đối tượng thử nghiệm không làm tốt hơn mức ngẫu nhiên trong việc phân biệt truyện ngắn hư cấu do con người viết và do ChatGPT tạo ra.
Trong thí nghiệm đầu tiên, mỗi người trong số 1.682 người tham gia đã đọc một trong sáu truyện ngắn, mỗi truyện dài khoảng 1.000 từ. Ba truyện đến từ các tạp chí văn học và tuyển tập truyện ngắn nổi tiếng. Ba truyện còn lại được tạo ra bằng ChatGPT 4.0, với các lời nhắc dựa trên chủ đề, phong cách và góc nhìn tường thuật của các bản gốc do con người viết.
Một nửa số người tham gia được cho biết câu chuyện được viết bởi một con người. Nửa còn lại được cho biết câu chuyện đến từ ChatGPT. Thông tin đó chính xác đối với một nửa số người tham gia trong mỗi nhóm, theo các nhà nghiên cứu Sydney Sears và Deena Skolnick Weisberg trong nghiên cứu của họ được công bố trên tạp chí Judgment and Decision Making.
Người tham gia đọc một câu chuyện do con người viết hoặc do AI tạo ra và được cho biết sự thật hoặc một lời nói dối về người đã viết nó. | Hình ảnh: Sears và Weisberg (2026)
Các câu chuyện của ChatGPT được đánh giá cao hơn đáng kể so với các văn bản do con người viết về cả chất lượng cảm nhận và sự nhập tâm. Về chất lượng, điểm trung bình cho các câu chuyện AI là 1,54 so với 0,97 cho các câu chuyện của con người trên thang điểm từ âm 3 đến dương 3. Về sự nhập tâm, khoảng cách là 1,42 so với 1,00.
Các câu chuyện AI (trái) được đánh giá cao hơn về chất lượng cảm nhận so với các câu chuyện của con người (phải). Khi người tham gia được cho biết một con người đã viết câu chuyện (màu cam), xếp hạng ở cả hai nhóm đều cao hơn khi câu chuyện được gán cho AI (màu xanh). | Hình ảnh: Sears và Weisberg (2026)
Thái độ của chính người tham gia đối với AI cũng định hình xếp hạng của họ. Bất kể ai thực sự viết câu chuyện, người tham gia đã cho điểm cao hơn khi được cho biết một con người là tác giả.
Những người tham gia có thái độ tích cực đối với AI thường đưa ra xếp hạng cao hơn trên toàn bộ. Khi họ cũng được cho biết câu chuyện đến từ ChatGPT, điểm số của họ thậm chí còn tăng cao hơn. Trong số những người tham gia hoài nghi về AI, hiệu ứng này đã đảo ngược. Một nghiên cứu trước đây về thơ do AI tạo ra đã tìm thấy một thành kiến tương tự.
Trong hai thí nghiệm nữa với tổng số 905 người tham gia, các nhà nghiên cứu đã làm cho nhiệm vụ khó hơn. Mỗi người đọc cả một câu chuyện do con người viết và một câu chuyện do AI tạo ra, sau đó phải tìm ra cái nào là cái nào. Ngay cả với một so sánh trực tiếp, người tham gia không thực hiện tốt hơn mức ngẫu nhiên.
Lời nhắc và giới thiệu cho một câu chuyện do AI tạo ra thông qua OSF
Kinh nghiệm tự báo cáo với các hệ thống AI tương quan tích cực với khả năng xác định chính xác nguồn gốc của các câu chuyện. Mặt khác, kinh nghiệm tự báo cáo với tiểu thuyết không giúp người tham gia phân biệt chúng.
Xếp hạng cao hơn không nhất thiết có nghĩa là viết tốt hơn
Các văn bản do AI tạo ra có xu hướng mượt mà hơn, dễ đọc hơn và mang sắc thái cảm xúc tích cực hơn so với văn bản do con người viết. Theo các tác giả, những đặc điểm này có thể giải thích cho việc đánh giá cao hơn mà không nhất thiết là các câu chuyện của AI tốt hơn về mặt văn học. Con người có xu hướng thích những tài liệu dễ tiếp nhận hơn.
Ngược lại, tiểu thuyết văn học chất lượng cao thường cố ý khó tiếp cận và đòi hỏi người đọc phải nỗ lực để nắm bắt ý nghĩa. Các nhà nghiên cứu cho rằng một câu chuyện có thể có chất lượng cao nhưng không hấp dẫn, và ngược lại.
Định dạng truyện ngắn cũng có thể là một lợi thế cho AI. Kể một câu chuyện mạch lạc trong 1.000 từ là một thách thức rất khác so với việc thực hiện điều đó trên hàng trăm trang. Tuy nhiên, kết luận của các nhà nghiên cứu rất rõ ràng: AI có thể tạo ra các tác phẩm sáng tạo mà con người nhận thấy ít nhất là ngang bằng với tác phẩm của con người, nhưng con người lại không tin rằng AI có khả năng đó.
Tất cả dữ liệu và tài liệu từ nghiên cứu đều có sẵn miễn phí trên Open Science Framework.
Một nghiên cứu từ tháng 10 năm ngoái của Đại học Stony Brook và Trường Luật Columbia cho thấy chuyên môn của người đọc chỉ quan trọng đến một mức độ nhất định. Với các câu lệnh đơn giản, những người đọc chuyên nghiệp rõ ràng thích các văn bản do con người viết hơn. Nhưng khi các mô hình được đào tạo cụ thể theo phong cách của từng tác giả, các chuyên gia đã thích các văn bản do AI tạo ra gấp tám lần về khả năng bắt chước phong cách và gấp đôi về chất lượng viết.



Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.