
Anthropic chia sẻ thêm chi tiết về cách thức hoạt động của các hình mờ (watermark) mới trên Claude.
Thủy ấn (watermarking) sẽ hoạt động như thế nào trên thực tế? Liệu có thể ẩn dấu thủy ấn bằng cách chỉnh sửa không? Và điều này ảnh hưởng đến mã nguồn (code) ra sao?
Anthropic đã đăng một bài viết trên blog vào thứ Sáu nhằm giải đáp một số câu hỏi cơ bản về cách công ty sẽ gắn dấu bản quyền (watermark) cho văn bản do chatbot Claude tạo ra. Chẳng hạn như: Dấu bản quyền sẽ hoạt động như thế nào? Có thể ẩn dấu bản quyền bằng cách chỉnh sửa không? Và điều này ảnh hưởng đến mã (code) ra sao?
Người dùng Claude đã tranh luận về động thái này kể từ khi công ty tiết lộ vào đầu tuần rằng họ sẽ thực hiện việc gắn dấu bản quyền để tuân thủ Quy tắc minh bạch của Đạo luật AI của Liên minh châu Âu (EU AI Act’s Transparency Code), yêu cầu các công ty AI sử dụng các hệ thống giúp nhận diện nội dung do AI tạo ra.
Trên Reddit, ví dụ, một người dùng đã mô tả đây là một âm mưu chống lại những người dùng Claude vô tội, trong khi một người khác tuyên bố: “Lý do duy nhất bạn không muốn điều này là để nói dối người khác.” Và Business Insider đưa tin rằng “hàng chục” người dùng trên X đã tuyên bố hủy đăng ký Claude của họ vì lý do này.
Bài viết mới của Anthropic bắt đầu với cái nhìn tổng quan về khái niệm dấu bản quyền, giải thích rằng khi đưa ra “những lựa chọn ít rủi ro” – như chọn giữa các từ “overcast” (trời u ám) và “grey” (xám xịt) để mô tả thời tiết – Claude có thể tạo ra một mẫu (pattern) trong các phản hồi của mình mà “người đọc không thể phát hiện, nhưng có thể phát hiện được bởi bất kỳ ai có khóa giải mã nó.”
“Việc gắn dấu bản quyền không ảnh hưởng đến chất lượng đầu ra của Claude,” công ty cho biết. “Đối với người đọc, một phản hồi có dấu bản quyền không thể phân biệt được với một phản hồi không có dấu bản quyền.”
Cụ thể hơn, Anthropic cho biết họ sẽ sử dụng phương pháp SynthID-Text mà nhóm Google DeepMind đã trình bày vào năm 2024, và họ có kế hoạch phát hành một API phát hiện dấu bản quyền. Công ty cũng lưu ý rằng việc gắn dấu bản quyền khác biệt với các phương pháp phát hiện AI được cung cấp bởi các công ty như Pangram, vốn tìm kiếm các “dấu hiệu” trong văn bản (như cấu trúc “his isn’t [X], it’s [Y]”) để tiết lộ việc sử dụng AI: “Việc nhận diện các mẫu này về cơ bản khác với việc kiểm tra dấu bản quyền.”
Liệu ai đó có thể viết lại văn bản để ẩn dấu bản quyền không? Anthropic cho biết điều đó là có thể, nhưng “chỉnh sửa nhẹ có thể sẽ không loại bỏ hoàn toàn dấu bản quyền,” trong khi “viết lại hoàn toàn, thay thế mọi từ, sẽ loại bỏ được.”
“Trong trường hợp sau, tất nhiên, có thể tranh cãi liệu văn bản đó còn có thể được mô tả là do AI tạo ra hay không,” công ty cho biết.
Về việc liệu dấu bản quyền có thể phát hiện được trong văn bản chỉ được Claude hiệu đính hoặc chỉnh sửa hay không, Anthropic cho biết điều đó sẽ phụ thuộc vào “độ dài của văn bản và mức độ Claude đã chỉnh sửa nó.” Nếu chỉ được chỉnh sửa nhẹ, “gần như tất cả các từ” sẽ do tác giả là con người viết và “có rất ít (nếu có) để dấu bản quyền gắn vào.”
Trong khi đó, mã (code) sẽ có ít dấu bản quyền hơn các văn bản khác, vì mô hình sẽ cần tạo ra mã hoạt động và sẽ không có quyền tự do lựa chọn giữa nhiều tùy chọn hợp lệ như nhau.
“Mặc dù vậy, trong những lĩnh vực có sự lựa chọn tùy ý giữa các từ hoặc thuật ngữ cụ thể trong mã, dấu bản quyền có thể được sử dụng, chẳng hạn như các bình luận trong mã,” Anthropic cho biết. “Nhưng theo định nghĩa, nó sẽ có tác động không đáng kể đến mã thực tế được tạo ra.”
Anthropic cũng cho biết Claude sẽ không phải là chatbot AI duy nhất tạo ra văn bản có dấu bản quyền, vì “các nhà phát triển mô hình lớn khác đã ký cùng một Bộ quy tắc thực hành (Code of Practice) và sẽ triển khai các dấu bản quyền của riêng họ.”
Anthony Ha là biên tập viên cuối tuần của TechCrunch. Trước đây, ông từng làm phóng viên công nghệ tại Adweek, biên tập viên cấp cao tại VentureBeat, phóng viên chính quyền địa phương tại Hollister Free Lance và phó chủ tịch nội dung tại một công ty đầu tư mạo hiểm. Ông hiện sống tại Thành phố New York.
Có thể liên hệ hoặc xác minh thông tin từ Anthony qua email anthony.ha@techcrunch.com.
Xem tiểu sử
Ngày 13 – 15 tháng 10
San Francisco
Mở rộng quy mô nhanh hơn. Phát triển danh mục đầu tư. Nâng cao chuyên môn thực tế. Dù mục tiêu của bạn là gì, Disrupt có thể giúp bạn đạt được.
Tiết kiệm tới 300 USD ngay hôm nay!
ĐĂNG KÝ NGAY
Được xem nhiều nhất
Một số người dùng Claude tức giận vì hình mờ mới của Anthropic sẽ khiến họ bị phát hiện khi sử dụng tại nơi làm việc, trường học
Lucas Ropek
Phoebe Gates và Sophia Kianni được cho là đã biết Phia "nhồi cookie" trong nhiều tháng
Dominic-Madori Davis
Delta điều tra sau khi có người thiết lập mạng Wi-Fi giả mạo giữa chuyến bay
Lorenzo Franceschi-Bicchierai
Anthropic cho biết sẽ gắn hình mờ vào văn bản được tạo bởi các mô hình AI của hãng
Ivan Mehta
Tuyên ngôn AI của Mark Zuckerberg chính xác là lý do mọi người không thích AI
Russell Brandom
YouTube hiện yêu cầu người sáng tạo phải có số giờ xem gấp đôi để bắt đầu kiếm tiền
Aisha Malik
Mẫu hình "đối kháng" này có thể ngăn camera giám sát phát hiện bạn
Zack Whittaker

Nguồn tin: TechCrunch AI — Tác giả: Anthony Ha. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.