
Claude của Anthropic sẽ thêm hình mờ vào văn bản và tệp do AI tạo
URL bài viết: https://www.cnet.com/tech/services-and-software/anthropics-claude-will-add-watermarks-to-ai-generated-text-and-files/ URL nhận xét: https://news.ycombinator.com/item?id=49339832 Điểm: 1 # Bình luận: 0
Công nghệ > Dịch vụ & Phần mềm > AI
Claude của Anthropic sẽ thêm hình mờ vào văn bản và tệp do AI tạo
Anthropic tham gia danh sách ngày càng nhiều các công ty cho phép khách hàng biết liệu họ có đang sử dụng nội dung AI hay không.
Alex Valdes
Kể từ khi bị mê hoặc bởi webcam cà phê Cambridge từ những năm 1990, tôi đã viết về VPN, NFL, điện thoại thông minh, mức lương đủ sống, trên/dưới và mọi thứ ở giữa. Đọc toàn bộ tiểu sử
Alex Valdes
Đọc toàn bộ tiểu sử
Ngày 17 tháng 8 năm 2026, 2:19 chiều theo giờ ET
đọc 5 phút
Anthropic đang thêm hình mờ vào các tệp, hình ảnh và thậm chí cả văn bản được tạo bởi các mô hình Claude AI của nó. James Martin/CNET
Bạn có thể sớm biết được thứ gì đó đến từ con người hay từ Claude. Anthropic cho biết trong tháng này rằng văn bản và tệp do dòng mô hình AI của họ tạo ra sẽ được đóng dấu hình mờ để cho người tiêu dùng biết. Sự thay đổi này sẽ cho phép công ty tuân thủ các quy định của EU về tính minh bạch của việc sử dụng AI.
Quy tắc thực hành của EU về tính minh bạch của nội dung do AI tạo ra yêu cầu các công ty cung cấp và triển khai hệ thống AI phải thông báo cho khách hàng khi họ tương tác với AI và đưa hình mờ vào nội dung AI. Người tiêu dùng cũng phải biết khi nào họ tiếp xúc với các công cụ deepfake cũng như nhận dạng cảm xúc và phân loại sinh trắc học. Ủy ban châu Âu cho biết gần 200 tổ chức đã đồng ý với các biện pháp này.
Hình chìm mờ – một quy trình xác thực bắt nguồn từ Ý vào thế kỷ 13 – hoàn toàn khác đối với nội dung AI. Hệ thống AI có thể tự động nhúng các điểm đánh dấu vào văn bản để chỉ ra rằng nội dung đó có nguồn gốc từ AI chứ không phải của con người. Ví dụ có thể là khoảng cách khác nhau giữa các từ và số, trình tự từ và các tín hiệu vô hình khác vẫn tồn tại trong văn bản ngay cả khi người đó sao chép và dán nó trên các nền tảng khác nhau. Người đọc không thể nhìn thấy những điểm đánh dấu này, nhưng hệ thống máy tính thì có thể.
Trong thông báo của mình, Anthropic cho biết các mẫu Claude ra mắt vào hoặc sau ngày 2 tháng 8 sẽ bao gồm hình mờ. Điều đó bao gồm nội dung do Claude tạo thông qua API, Claude, Claude Code, Claude Cowork và Claude Tag. Hình mờ sẽ áp dụng cho tất cả nội dung do Claude tạo ở bất kỳ nơi nào hệ thống AI được cung cấp, không chỉ ở EU.
Anthropic cho biết họ sẽ “sớm” chia sẻ thông tin chi tiết về cách khách hàng có thể kiểm tra xem văn bản có được tạo ra bởi AI hay không.
Tính minh bạch của AI đang là xu hướng ngày càng tăng. Substack hợp tác với Pangram để cho người đọc biết một bài đăng được tạo ra bởi AI, nếu có. Suno gần đây đã công bố những thay đổi để giúp người nghe biết liệu một bài hát có phải do AI tạo ra hay không. Nếu khách hàng của LinkedIn nghi ngờ AI có sự trục trặc, họ có thể cho LinkedIn biết. Tính năng mới của Spotify, AI Persona, cho phép người nghe và người sáng tạo biết loại nhạc nào được tạo ra bằng AI.
Văn bản sẽ được đóng dấu như thế nào
Để tóm tắt một quy trình phức tạp khác, Anthropic cho biết văn bản do mô hình Claude tạo ra sẽ có thể được phát hiện do cách chọn từ. Nếu có đủ văn bản, công cụ phát hiện AI sẽ có thể phát hiện ra mẫu mà chỉ mô hình Claude mới sử dụng để tạo văn bản.
Anthropic cho biết, hình mờ văn bản sẽ không làm giảm chất lượng nội dung và người đọc sẽ không thể phân biệt được sự khác biệt giữa văn bản có hình mờ và văn bản không có hình mờ nếu không sử dụng công cụ phát hiện AI.
Công ty cho biết: “Trong thử nghiệm nội bộ, chúng tôi không thấy tác động của hình mờ đến nội dung, mức độ sáng tạo hoặc khả năng đọc văn bản của Claude”.
Anthropic cho biết công cụ của họ dựa trên hệ thống SynthID mà Google đang sử dụng để phát hiện AI trong văn bản, hình ảnh, video và âm thanh. Cách SynthID phát hiện AI trong nội dung văn bản được mô tả trong bài báo Nature xuất bản năm 2024.
Đọc thêm: Tôi đã sử dụng mọi ứng dụng và trình phát hiện gian lận AI và đi đến một kết luận
Các hình mờ mà Claude thêm vào văn bản sẽ vẫn giữ nguyên, ngay cả khi văn bản được sao chép và dán từ các trình soạn thảo văn bản như Notepad của Windows hoặc TextEdit của MacOS. Các dấu vết cũng có thể không bị loại bỏ thông qua chỉnh sửa của con người.
Công ty cho biết: “Hình mờ sẽ được áp dụng ở cấp độ mô hình, có nghĩa là nó sẽ hiện diện cho dù văn bản đến từ sản phẩm hay bề mặt nào của Claude”.
Hình ảnh sẽ được đóng dấu như thế nào
Anthropic cho biết Claude sẽ đính kèm các ghi chú được ký bằng mật mã trong siêu dữ liệu của các tệp như .png, .jpg hoặc .svg để chỉ rõ rằng các tệp này đã được tạo hoặc xử lý bằng Claude. Anthropic cho biết đây là một phần của quy trình tiêu chuẩn, được gọi là C2PA, được sử dụng trong các nhà sản xuất phần mềm chỉnh sửa ảnh và máy ảnh để ghi lại hình ảnh đến từ đâu.
Nếu ai đó cố gắng giả mạo nó - ví dụ: cố gắng che giấu rằng nó được tạo ra bởi AI - thì chữ ký mật mã sẽ bị hỏng và do đó sẽ cho người đọc thấy rằng nó đã bị giả mạo.
Nó không phải là điều dễ hiểu
Anthropic đã đưa ra lời cảnh báo trong thông báo của mình. Sự hiện diện của hình mờ không nhất thiết có nghĩa là nội dung hoặc hình ảnh được tạo bởi Claude và việc không có hình mờ cũng không có nghĩa là Claude không liên quan.
Ví dụ: giả sử ai đó muốn sử dụng lại bài luận của một nhà văn khác. Họ ném bài luận vào Claude và yêu cầu AI viết lại nó. Đầu ra sẽ có hình mờ, nhưng thông tin thực tế và chi tiết của nội dung đến từ người viết chứ không phải AI. Công ty cho biết mọi người thường sử dụng Claude để hiệu đính, dịch thuật và tóm tắt.
Ai đó cũng có thể lấy nội dung từ Claude và chỉnh sửa rồi kết hợp nó với văn bản khác. Ngay cả khi chỉ một phần nhỏ của bản thảo cuối cùng là của Claude, thì vẫn có thể có hình mờ, có thể làm suy yếu tính hợp pháp của tài liệu đối với người đọc.
Anthropic cho biết: “Chỉnh sửa nhẹ có thể sẽ không loại bỏ hoàn toàn hình mờ. “Một bản viết lại hoàn chỉnh sẽ được thay thế từng từ.”
Đọc thêm: Học sinh gian lận bằng AI đã khiến ngôi trường Ivy League này thay đổi truyền thống 133 năm tuổi
Anthropic cho biết nội dung được tạo ra hoặc pr



Nguồn tin: Hacker News AI — Tác giả: wglb. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.