Bỏ qua tới nội dung chính
Quay lại tin tức

Anthropic gắn dấu bản quyền (watermark) lên tất cả các sản phẩm đầu ra của Claude trên toàn cầu. Các dấu này "có thể tồn tại qua một số chỉnh sửa".

The Decoder· Matthias Bastian· 11/8/2026general

Anthropic sẽ nhúng các hình mờ vô hình vào tất cả văn bản do Claude tạo ra và ký các tệp bằng tiêu chuẩn C2PA. Các mô hình mới ra mắt từ tháng 8 năm 2026 trở đi sẽ được tích hợp tính năng gắn nhãn ngay từ đầu. Chính sách này áp dụng trên toàn thế giới và Anthropic có kế hoạch cung cấp các công cụ phát hiện để bên thứ ba xác minh. Bài viết Anthropic gắn hình mờ vào tất cả các đầu ra của Claude trên toàn cầu với các dấu hiệu "có thể tồn tại qua một số chỉnh sửa" xuất hiện lần đầu trên The Decoder.

AI trong thực tiễn Anthropic gắn dấu thủy vân (watermark) cho tất cả các nội dung do Claude tạo ra trên toàn cầu với các dấu hiệu "có thể tồn tại qua một số chỉnh sửa". Matthias Bastian Ngày 11/8/2026 Các điểm chính Anthropic đã ký Bộ Quy tắc Thực hành Đạo luật AI của EU và sẽ trang bị nhãn nhận dạng bằng máy cho tất cả các mô hình Claude mới bắt đầu từ tháng 8/2026. Yêu cầu này áp dụng trên toàn thế giới. Văn bản sẽ có dấu thủy vân vô hình (invisible watermark) có thể tồn tại khi sao chép. Các tệp như hình ảnh sẽ có siêu dữ liệu nguồn gốc được ký theo tiêu chuẩn C2PA. Anthropic thừa nhận những hạn chế: dấu thủy vân không chứng minh Claude đã viết nội dung, vì người dùng thường sử dụng AI để chỉnh sửa hoặc dịch văn bản của chính họ. Việc chỉnh sửa nhiều hoặc thay đổi định dạng cũng có thể loại bỏ hoàn toàn các dấu hiệu này; tuy nhiên, nó "có thể tồn tại qua một số chỉnh sửa". Anthropic đã ký Bộ Quy tắc Thực hành Đạo luật AI của EU về tính minh bạch đối với nội dung do AI tạo ra. Bắt đầu từ tháng 8/2026, các mô hình Claude mới sẽ nhúng dấu thủy vân vào văn bản và đính kèm siêu dữ liệu nguồn gốc đã ký vào các tệp. Các mô hình Claude ra mắt tại EU vào hoặc sau ngày 2/8/2026 sẽ được tích hợp tính năng gắn nhãn này. Yêu cầu sẽ không chỉ dừng lại ở biên giới EU. Nó sẽ áp dụng trên toàn cầu cho tất cả các sản phẩm Claude, bao gồm API, Claude, Claude Code, Claude Cowork và Claude Tag. Văn bản được tạo ra sẽ mang dấu thủy vân nhúng, trong khi các tệp được tạo ra sẽ nhận siêu dữ liệu nguồn gốc được ký điện tử. Các mô hình hiện có sẽ có một giai đoạn chuyển tiếp theo luật, nhưng Anthropic cho biết họ đang nỗ lực để trang bị lại cho chúng. Công ty cũng có kế hoạch phát hành các công cụ xác minh để người dùng và bên thứ ba có thể kiểm tra các nhãn, mặc dù chưa công bố thời gian cụ thể. Anthropic cho biết các nhà phát triển tích hợp Claude vào sản phẩm của họ phải xác định các yêu cầu của Điều 50 nào áp dụng cho dịch vụ của họ. Hai phương pháp để nhận dạng nội dung AI Anthropic có kế hoạch sử dụng hai loại nhãn. Văn bản do Claude tạo ra sẽ mang một dấu thủy vân vô hình không ảnh hưởng đến ý nghĩa, chất lượng hoặc khả năng đọc của nó, theo công ty. Dấu thủy vân này tồn tại khi sao chép và dán, và "có thể tồn tại qua một số chỉnh sửa". Nó được áp dụng ở cấp độ mô hình, vì vậy không quan trọng bạn đang sử dụng sản phẩm Claude nào. Các tệp được hỗ trợ, bao gồm hình ảnh .svg, .png và .jpg, sẽ mang siêu dữ liệu nguồn gốc được ký dựa trên tiêu chuẩn mở C2PA, được phát triển bởi Liên minh về Nguồn gốc và Tính xác thực Nội dung (Coalition for Content Provenance and Authenticity). Chữ ký này cho biết Claude đã xử lý tệp và có thể tiết lộ các hành vi giả mạo sau này. Dấu thủy vân văn bản cũng sẽ hoạt động thông qua các đối tác đám mây như AWS, Google Cloud và Microsoft Foundry, mặc dù các nền tảng đó có thể không hỗ trợ siêu dữ liệu đã ký. Việc phát hiện có một số hạn chế Anthropic thẳng thắn về những hạn chế. Một dấu thủy vân được phát hiện không có nghĩa là Claude thực sự đã viết nội dung. Người dùng thường xuyên sử dụng Claude để hiệu đính, dịch hoặc tóm tắt, vì vậy đầu ra có thể mang dấu thủy vân mặc dù ý tưởng xuất phát từ con người. Việc không có hình mờ cũng không làm mọi thứ rõ ràng hơn. Mô hình có thể đã được phát hành trước khi tính năng hình mờ được triển khai, văn bản có thể đã được chỉnh sửa hoặc dịch nhiều, đoạn văn có thể quá ngắn để phát hiện đáng tin cậy, hoặc siêu dữ liệu đã bị loại bỏ thông qua chuyển đổi định dạng hoặc chụp màn hình. Thử nghiệm thực sự là khả năng các hình mờ này tồn tại sau khi chỉnh sửa, định dạng lại và dịch thuật. Nếu chúng vẫn giữ được, việc kiểm tra hình mờ đã biết sẽ đáng tin cậy hơn các công cụ như Pangram, với các phương pháp phát hiện độc quyền không tiết lộ điều gì đã kích hoạt kết quả. Các công cụ phát hiện của bên thứ ba có thể bổ sung hỗ trợ cho hình mờ của Anthropic, mang lại tín hiệu đáng tin cậy hơn. Phát hiện văn bản AI vẫn là một vấn đề nhạy cảm trong xã hội. Anthropic không đơn độc trong vấn đề này. Google Deepmind đã công bố mã nguồn hệ thống hình mờ SynthID của mình, tích hợp nó vào các mô hình Gemini. SynthID điều chỉnh nhẹ các giá trị xác suất trong quá trình dự đoán token để tạo hình mờ mà không làm giảm chất lượng văn bản. Nó hoạt động trên nhiều ngôn ngữ nhưng gặp khó khăn với văn bản đã được chỉnh sửa sau khi tạo. OpenAI đã có một công cụ phát hiện văn bản với độ chính xác 99,9% trong khoảng hai năm nhưng vẫn chưa phát hành. Các lý do bao gồm việc người dùng có thể dễ dàng đánh lừa nó thông qua dịch thuật hoặc viết lại, nguy cơ kỳ thị một số nhóm nhất định, và có thể là lo ngại rằng một công cụ phát hiện công khai có thể gây tổn hại đến hoạt động kinh doanh của OpenAI. Nguy cơ đó đặc biệt nghiêm trọng trong giáo dục, nơi các công cụ phát hiện không đáng tin cậy có thể dẫn đến các cáo buộc gian lận sai. Đồng thời, có những lý do chính đáng để muốn biết khi nào và mức độ AI đã được sử dụng. Các nghiên cứu cho thấy việc phụ thuộc nhiều vào các công cụ AI có thể làm suy yếu tư duy phản biện và kỹ năng viết, đặc biệt là ở những sinh viên coi chúng là một lối tắt thay vì một công cụ hỗ trợ học tập. Vấn đề không chỉ giới hạn trong học thuật, khi những kẻ lừa đảo hiện đang ghi danh sinh viên giả vào các trường cao đẳng Hoa Kỳ và sử dụng AI để hoàn thành khóa học một cách dễ dàng và nhận hỗ trợ tài chính. Quyết định của Anthropic cũng có thể ảnh hưởng đến hoạt động kinh doanh của công ty. Claude phổ biến trong công việc tri thức, đặc biệt là đối với học sinh và sinh viên đại học, vì ngay cả các mô hình cũ hơn cũng tạo ra văn xuôi khá tự nhiên. Với việc các trường học và đại học đang tranh cãi về việc sử dụng AI trong công việc học thuật, việc phát hiện đáng tin cậy hơn có thể khiến Claude kém hấp dẫn hơn đối với những người dùng đó.

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.