Cách xóa hình mờ Claude khỏi văn bản, mã và tệp
Claude hiện đánh dấu nội dung do AI tạo ra. Nhưng nó không đánh dấu mọi thứ theo cùng một cách. Anthropic hiện sử dụng hình mờ được nhúng cho văn bản và siêu dữ liệu xuất xứ C2PA đã ký cho các tệp được hỗ trợ. Mã nằm ở đâu đó ở giữa: nó vẫn là văn bản, nhưng cấu trúc của nó khiến hình mờ có ít vị trí hoạt động hơn. Tôi đã đi vào chi tiết về hình mờ của Claude […] Bài đăng Cách xóa hình mờ Claude khỏi văn bản, mã và tệp xuất hiện đầu tiên trên Analytics Vidhya.
-->
Cách xóa hình mờ Claude khỏi văn bản, mã và tệp
Hội nghị AI tương lai nhất của Ấn Độ đã trở lại - Lớn hơn, sắc nét hơn, táo bạo hơn
-->
d
:
h
:
tôi
:
s
Nhận thông tin chi tiết
-->
DeepSeek-->
Khóa học miễn phí
Các khóa học miễn phí-->
Lộ trình học tập-->
Chương trình tăng tốc -->
Chương trình tăng tốc -->
Mới -->
Chương trình đỉnh cao GenAI-->
GenAI đỉnh cao Plus
Tiên phong AI đặc vụ
Mới-->
DeepSeek-->
Hội nghị thượng đỉnh DataHack 2025-->
DHS 2026
Các khóa học miễn phí-->
Đăng nhập
Chuyển đổi chế độ
Đăng xuất
-->
Chuẩn bị phỏng vấn
Sự nghiệp
GenAI
Lời nhắc nhở
Trò chuyệnGPT
LLM
chuỗi lang
RAG
Đại lý AI
Học máy
Học sâu
Công cụ GenAI
LLMOps
Python
NLP
SQL
Dự án AIML
Danh sách đọc
Lộ trình học tập phân tích dữ liệu
Cách trở thành Nhà phân tích dữ liệu vào năm 2025: Lộ trình hoàn chỉnh
Lộ trình học tập Tableau
Lộ trình học tập toàn diện đến Tableau vào năm 2025
Lộ trình học tập NLP
Lộ trình học NLP toàn diện 2025
Lộ trình học tập của nhà khoa học dữ liệu
Lộ trình học tập để trở thành nhà khoa học dữ liệu vào năm 2025
Lộ trình học tập kỹ sư dữ liệu
Lộ trình từng bước để trở thành Kỹ sư dữ liệu vào năm 2025
Lộ trình học tập MLOps
Lộ trình học tập MLOps toàn diện: Phiên bản 2025
Lộ trình học tập kỹ sư AI
Lộ trình trở thành Kỹ sư AI vào năm 2025
Lộ trình học tập thị giác máy tính
Lộ trình học tập toàn diện để làm chủ thị giác máy tính vào năm 2025
Lộ trình học tập AI sáng tạo
Lộ trình tốt nhất để học Generative AI vào năm 2025
Lộ trình AI sáng tạo cho doanh nghiệp
Lộ trình GenAI cho doanh nghiệp
Lộ trình LLM
Các mô hình ngôn ngữ lớn được làm sáng tỏ: Lộ trình cho người mới bắt đầu
Con đường nghiêng của kỹ sư nhanh chóng
Lộ trình học tập để trở thành Chuyên gia Kỹ thuật nhanh chóng
Trang chủ
LLM
Cách xóa hình mờ Claude khỏi văn bản, mã và tệp
Cách xóa hình mờ Claude khỏi văn bản, mã và tệp
Vasu Deo Sankrityayan
Cập nhật lần cuối:
19 tháng 8 năm 2026
đọc 6 phút
Claude hiện đánh dấu nội dung do AI tạo ra. Nhưng nó không đánh dấu mọi thứ theo cùng một cách.
Anthropic hiện sử dụng hình mờ được nhúng cho văn bản và siêu dữ liệu xuất xứ C2PA đã ký cho các tệp được hỗ trợ. Mã nằm ở đâu đó ở giữa: nó vẫn là văn bản, nhưng cấu trúc của nó khiến hình mờ có ít vị trí hoạt động hơn.
Tôi đã trình bày chi tiết về hình mờ của Claude trong bài viết của mình về cách hoạt động của hình mờ của Claude và ở đây tôi sẽ trả lời câu hỏi hiển nhiên:
Làm thế nào để bạn loại bỏ hình mờ?
Bạn sẽ sớm nhận ra rằng hình mờ không khó để loại bỏ chút nào.
Mục lục
Xóa hình mờ Claude khỏi văn bản
Xóa hình mờ Claude khỏi mã
Xóa hình mờ Claude khỏi tệp
Còn các tệp PDF và các tệp khác thì sao?
Bạn có thể loại bỏ hoàn toàn nhãn hiệu?
Giải pháp thiết thực
Câu hỏi thường gặp
Xóa hình mờ Claude khỏi văn bản
Đây là trường hợp khó nhất. Ít nhất là trên giấy tờ, bởi vì:
Trên thực tế, Claude không thêm một ký tự ẩn nào để bạn có thể tìm kiếm và xóa.
Anthropic cho biết hình mờ của nó dựa trên SynthID-Text. Đây là biến thể văn bản của SynthID truyền thống được các mô hình Gemini sử dụng để tạo hình chìm mờ.
Hơn nữa, mô hình thay đổi nguồn ngẫu nhiên mà nó sử dụng khi lựa chọn giữa các từ có thể. Xuyên suốt một đoạn văn đủ dài, những lựa chọn đó tạo ra một mẫu thống kê có thể được phát hiện sau này.
Ví dụ,
Nhấn vào đây để xem chức năng của SynthID-Text
Xác suất LLM và chức năng tạo hình mờ ngẫu nhiên
Lấy mẫu giải đấu: tạo quá mức với lựa chọn lặp lại dựa trên hình mờ
Hãy suy nghĩ về ba câu sau:
Trình biên dịch đã từ chối bản vá.
Bản vá đã bị trình biên dịch từ chối.
Trình biên dịch sẽ không chấp nhận bản vá.
Về cơ bản, chúng đang chuyển tiếp cùng một thông tin, mặc dù theo một cách khác (từ ngữ khôn ngoan). Con người khó có thể phát hiện ra sự thay đổi nhỏ này, nhưng máy móc có thể ẩn các mẫu bằng cách sử dụng những lựa chọn có vẻ an toàn như vậy.
Ngoài ra, một mô hình có một số quyền tự do lựa chọn giữa chúng. Vì vậy, sự tự do đó chính là nơi đặt hình mờ văn bản. Tất cả đều nằm trong khuôn mẫu…
Viết lại, đừng “lột bỏ”
Tuy nhiên, không có hoạt động làm sạch siêu dữ liệu nào cho hình mờ văn bản của Claude. Vì hình mờ là một mẫu được phân bổ trên văn bản:
Chỉnh sửa sẽ không đủ
Sao chép văn bản sang trình soạn thảo khác không giải quyết được
Vậy thì cái gì có tác dụng?
Viết lại hoặc diễn giải đáng kể
Viết lại văn bản là lựa chọn lý tưởng để chống hình mờ. Nhưng nếu bạn không quan tâm đến việc chỉnh sửa lại thì việc diễn giải là đủ. Tương tự, điều này rất quan trọng vì có rất nhiều công cụ diễn giải có sẵn miễn phí trên mạng:
Điều đó cho chúng ta một quy tắc đơn giản:
Tuy nhiên, việc thay đổi tệp không xóa hình mờ văn bản. Thay đổi văn bản nào.
Cách tiếp cận Python
Vì hình mờ có trong văn bản của Claude nên việc làm lại văn bản trong các LLM khác (không có SynthID-Text) sẽ làm giảm hình mờ.
Đoạn mã sau sử dụng điểm cuối chung tương thích với OpenAI. Sử dụng một mô hình khác ngoài Claude để viết lại:
hệ điều hành nhập khẩu
từ openai nhập OpenAI
def rewrite_text(text: str) -> str:
client = OpenAI(api_key=os.environ["OPENAI_API_KEY"])
nhắc = f"""
Viết lại hoàn toàn đoạn văn sau bằng từ ngữ mới.
Quy tắc:
- Bảo tồn sự thật và ý nghĩa.
- Đảm bảo độ chính xác kỹ thuật.
- Thay đổi cấu trúc câu xuyên suốt.
- Đừng chỉ thay thế một vài từ bằng từ đồng nghĩa.
- Xây dựng lại các đoạn văn nếu thấy hữu ích.
- Chỉ trả lại văn bản viết lại.
VĂN BẢN:
{văn bản}
"""
phản hồi = client.responses.create(
model=os.getenv("REWRITE_MODEL", "gpt-5"),
đầu vào=nhắc nhở,
)
trả về phản hồi.output_text
nếu __name__ == "__main__":
gốc = open("input.txt", "r", mã hóa="utf-8").read()
viết lại


Nguồn tin: Analytics Vidhya — Tác giả: Vasu Deo Sankrityayan. Bản dịch tiếng Việt do AI thực hiện, có thể có sai sót.