Bỏ qua tới nội dung chính
Quay lại tin tức

Anthropic công bố API phát hiện dấu thủy (watermark) cho phép các bên thứ ba nhận diện văn bản do AI Claude tạo ra.

The Decoder· Matthias Bastian· 14/8/2026general

Anthropic sẽ sớm cung cấp một giao diện lập trình ứng dụng (API) phát hiện dấu thủy ấn, cho phép các bên thứ ba kiểm tra xem văn bản có phải do Claude viết hay không. Theo Anthropic, công nghệ này được xây dựng dựa trên phương pháp SynthID của Google và điều chỉnh tính ngẫu nhiên trong quá trình chọn từ mà không ảnh hưởng đến chất lượng văn bản. Phương pháp này có những hạn chế đối với văn bản chứa nhiều dữ kiện, mã lập trình và các trường hợp viết lại nhiều. Bài viết Anthropic announces watermark detection API that will let third parties detect Claude's AI texts xuất hiện lần đầu trên The Decoder.

Anthropic công bố API phát hiện hình mờ, cho phép bên thứ ba phát hiện văn bản AI của Claude Matthias Bastian Ngày 14/8/2026 Anthropic sẽ sớm cung cấp một API phát hiện hình mờ, cho phép các nhà phát triển bên thứ ba tích hợp tính năng phát hiện văn bản AI vào ứng dụng của họ. Công ty sử dụng một biến thể của phương pháp SynthID Text mà Google Deepmind đã công bố trên tạp chí Nature vào năm 2024 cho mô hình AI Claude của mình. Hình mờ điều chỉnh nguồn ngẫu nhiên trong quá trình chọn từ, tạo ra một mẫu có thể truy vết. Theo Anthropic, điều này không ảnh hưởng "đến nội dung, mức độ sáng tạo hoặc khả năng đọc của văn bản do Claude tạo ra". Google Deepmind đã minh họa quá trình này vào năm 2024 bằng hình ảnh động sau. Hình mờ hoạt động kém tin cậy hơn đối với các văn bản ngắn hoặc đoạn văn chứa nhiều thông tin thực tế, nơi không có nhiều cách diễn đạt thay thế. Điều tương tự cũng áp dụng cho mã (code). Các bản sửa lỗi thuần túy, trong đó con người chọn từng từ, cũng sẽ không mang hình mờ. Bản dịch là một trường hợp khác, vì Claude chọn tất cả các từ trong đó. Anthropic cho biết trong một FAQ đã công bố rằng việc viết lại nhiều có thể loại bỏ hình mờ. Hình mờ chỉ có thể báo hiệu rằng Claude có thể đã tham gia vào việc tạo ra một văn bản. Nó không thể cho biết liệu Claude đã viết toàn bộ văn bản hay chỉ chỉnh sửa nhiều, và nó cũng không thể xác định liệu một văn bản đến từ con người hay một mô hình AI khác. Quy định của EU thúc đẩy triển khai toàn cầu Anthropic đang bổ sung tính năng hình mờ để tuân thủ Đạo luật AI của EU. Cùng với khoảng 190 bên ký kết khác, công ty đã ký Bộ Quy tắc Thực hành của EU về tính minh bạch đối với nội dung do AI tạo ra vào tháng 7/2026. Vì hiện tại không có cách kỹ thuật nào để giới hạn tính năng này theo khu vực, tính năng hình mờ sẽ được triển khai trên toàn thế giới. Theo Anthropic, công ty đang liên tục khám phá thêm các lựa chọn, với các bản cập nhật sẽ được công bố sau. Tất cả các mô hình được phát hành sau ngày 2/8/2025 đều hỗ trợ tính năng hình mờ ngay từ đầu. Các mô hình Claude cũ hơn sẽ nhận được tính năng này trong những tháng tới. Đối với các tệp, Anthropic sử dụng tiêu chuẩn C2PA mở, tiêu chuẩn này đính kèm siêu dữ liệu mà không làm thay đổi bản thân tệp. Tính năng hình mờ của Anthropic hoạt động khác với các công cụ phát hiện AI bên ngoài như Pangram. Các dịch vụ đó không có quyền truy cập vào khóa của Anthropic. Thay vào đó, chúng quét các mẫu điển hình trong văn bản AI, chẳng hạn như cách diễn đạt đặc trưng hoặc các từ bị lạm dụng. Kiểm tra hình mờ là một cách tiếp cận cơ bản khác và được kỳ vọng sẽ đáng tin cậy hơn trong thực tế. Nguồn: Anthropic

Nguồn tin: The Decoder — Tác giả: Matthias Bastian. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.