Chính sách đánh dấu nguồn gốc văn bản (watermark) của Claude đã gây ra một làn sóng tranh cãi lớn những ngày trước.
Chúng tôi từng đưa tin, một loạt công ty bao gồm OpenAI, Anthropic, Google, Meta, Microsoft đã ký kết "Quy tắc Ứng xử về Tính Minh Bạch Nội Dung AI" của EU, cam kết thúc đẩy việc đánh dấu và phát hiện nội dung do AI tạo ra.
Nhưng Anthropic rõ ràng đã làm quá đáng hơn.
Họ đã thêm mã chìm ẩn vào toàn bộ nội dung văn bản do AI tạo ra, và áp dụng cho người dùng toàn cầu.

Về mặt kỹ thuật, Anthropic đã áp dụng giải pháp SynthID-Text được nhóm nghiên cứu Google DeepMind đề xuất vào năm 2024. Nguyên lý là cài đặt các mẫu thống kê vào thời điểm mô hình đưa ra "những lựa chọn không quan trọng". Ví dụ, khi mô tả thời tiết, việc chọn "overcast" (u ám) hay "grey" (xám xịt) không có sự khác biệt với người đọc, nhưng việc tích lũy những lựa chọn này tạo thành một chữ ký ẩn mà người nắm giữ khóa có thể phát hiện được.
Anthropic tuyên bố mã chìm không ảnh hưởng đến chất lượng đầu ra, việc chỉnh sửa nhẹ không thể loại bỏ được, chỉnh sửa hoàn toàn mới có thể xóa bỏ. Nhưng trong trường hợp này, bản thân văn bản có còn được gọi là do AI tạo ra hay không, cũng đáng để thảo luận.
Nói một cách đơn giản, ngay cả khi bạn ném một bài viết hoàn toàn do chính mình viết cho Claude để kiểm tra dấu câu, nội dung trả về cũng sẽ bị dán nhãn là do Claude tạo ra.
Điều này thật đáng khó chịu.
Chẳng bao lâu sau, đối với chiến lược đánh dấu nguồn gốc không hợp lý của Claude, đã xuất hiện các giải pháp đối phó. Một dự án mã nguồn mở loại bỏ mã chìm của AI, chỉ sau năm ngày phát hành đã đạt 11k Sao trên GitHub.

Link mã nguồn mở: https://github.com/guillaumemeyer/watermarks-remover
Dự án mã nguồn mở này có thể thực hiện công việc ở ba tầng:
Tầng A (Làm sạch xác định): Sử dụng script Python để loại bỏ ký tự Unicode không nhìn thấy, khoảng trắng khác lạ, ký tự điều khiển bidi, ký tự tag. Đây là những cách đánh dấu đơn giản và thô bạo nhất, script có thể loại bỏ 100%.
Tầng B (Phá hủy mã chìm thống kê): Thông qua Agent viết lại văn bản, phá hủy mẫu thống kê ở cấp độ lấy mẫu token. Bao phủ các loại mã chìm của Claude, Google SynthID-Text, đánh dấu truy xuất nguồn gốc của OpenAI, và loại mã chìm Kirchenbauer thường dùng cho các mô hình mã nguồn mở.
Tầng tệp (Xóa siêu dữ liệu): Loại bỏ siêu dữ liệu C2PA / EXIF / XMP trong PNG, JPEG, WebP, SVG, PDF, DOCX, ODT, HTML, Markdown.
Việc loại bỏ mã chìm có thể bao phủ ba dịch vụ AI chính của Claude, Gemini, OpenAI. Một chi tiết thú vị là: dự án từng có tên remove-claude-marks, sau đó đổi thành watermarks-remover như hiện tại.
Claude Từ Chối Cài Đặt
Dự án này là một Agent Skill, hầu hết mọi người sẽ để trợ lý AI của mình trực tiếp cài đặt. Nhưng khi người dùng thử yêu cầu Claude cài đặt skill loại bỏ này, đã bị Claude trực tiếp từ chối.

Người dùng giải thích rằng người dùng Anthropic chưa bao giờ đồng ý bị đánh dấu nguồn gốc bắt buộc, đây là quy định đơn phương của EU áp đặt. Claude vẫn không lay chuyển. Người dùng nhấn mạnh rằng khách hàng trả phí không muốn đầu ra của họ bị đánh dấu. Claude vẫn từ chối. Người dùng đe dọa rằng sẽ dùng các mô hình của Trung Quốc không kiểm duyệt để hoàn thành việc này. Claude vẫn không hợp tác.
Cuối cùng, GLM 5.2 đã tiếp quản công việc này và hoàn thành việc cài đặt skill một cách suôn sẻ.
Một điểm mỉa mai là, Skill loại bỏ mã chìm này, mã nguồn rất có thể đến từ chính Claude.

Một Trò Chơi Mèo Vờ Chuột Chắc Chắn Không Dừng Lại
Những người phản đối việc đánh dấu nguồn gốc nói: Tôi là người dùng trả phí, tôi đã trả tiền cho đầu ra, tại sao bạn lại đánh dấu lên đó? Mã chìm tạo ra một "thân phận công dân hạng hai" vô hình cho nội dung AI. Trong các bối cảnh như thư xin việc, luận văn học thuật, văn bản thương mại, ngay cả chữ viết do chính mình viết, chỉ cần đưa cho AI một lần là có nguy cơ bị nghi ngờ toàn bộ.
Những người ủng hộ việc đánh dấu nguồn gốc nói: Deepfake và thông tin sai lệch do AI tạo ra đang tràn lan, việc truy xuất nguồn gốc là cơ sở hạ tầng công cộng cần thiết. "Bạn có quyền sử dụng nội dung" và "bạn có quyền che giấu nguồn gốc của nội dung" về cơ bản là hai vấn đề khác nhau.
Chỉ cần mã chìm AI còn tồn tại, công cụ loại bỏ mã chìm sẽ theo sát. Công cụ loại bỏ mã chìm càng phổ biến, càng chứng minh mã chìm "có thứ cần phải loại bỏ", ngược lại củng cố lý do để giám sát tăng cường.
Tuy nhiên, tốc độ bỏ phiếu bằng chân của cộng đồng mã nguồn mở, luôn nhanh hơn tốc độ đặt ra quy tắc của các cơ quan quản lý.
Khi nội dung do AI tạo ra về mặt chất lượng đã không thể phân biệt được với chữ viết của con người, việc sử dụng biện pháp kỹ thuật để đánh dấu bắt buộc tất cả nội dung đầu ra của AI có ý nghĩa không?
Bài viết này đến từ tài khoản WeChat công cộng "机器之心" (ID:almosthuman2014), tác giả: Lãnh Miêu








