Phan Huy
Moderator
Anthropic đã chính thức công bố một thông tin chèn watermark vào nội dung do AI tạo ra.
Quy định này nhằm tuân thủ Đạo luật AI của châu Âu và sẽ bắt buộc áp dụng từ tháng 8 năm 2026.
Watermark này ko phải chỉ mỗi hình ảnh mà các content chữ cũng có watermark nha. Và tất nhiên nhiều anh em chưa hiểu watermark ở content text như nào.
Mình sẽ giải thích ngắn gọn để mọi người dễ hình dung nhất. Cơ chế đánh dấu của Claude hoạt động ra sao?
Hệ thống chia làm hai loại xử lý tùy theo định dạng mà anh em yêu cầu.
Đối với hình ảnh/File (.png, .svg...): Claude sẽ đính kèm Metadata C2PA. Cái này giống như nhãn mác số, quét metadata là ra ngay (dễ hiểu, dễ xóa nếu chụp màn hình hoặc đổi định dạng).
Đối với văn bản, Claude sử dụng kỹ thuật nhúng hình mờ trực tiếp vào câu chữ.
Kỹ thuật này không phải là chèn mã HTML ẩn hay khoảng trắng vô hình để anh em copy qua Notepad là sạch.
Nó can thiệp trực tiếp vào thuật toán chọn từ vựng của AI.
Model sẽ ngầm chia từ vựng thành danh sách ưu tiên và danh sách hạn chế.
Khi gen văn bản, AI sẽ liên tục chọn các từ nằm trong danh sách ưu tiên theo một tỷ lệ cố định. Mắt thường đọc vẫn thấy rất tự nhiên, nhưng tool check của Claude sẽ dễ dàng phát hiện ra dấu vết thống kê này.
Không có Watermark: "Nếu bạn đang tìm kiếm một chiếc máy pha cà phê espresso hoàn hảo cho gia đình, bài viết này sẽ giúp bạn đưa ra lựa chọn tốt nhất."
Có Watermark: "Nếu bạn đang tìm kiếm một chiếc máy pha cà phê espresso hoàn hảo cho gia đình, bài viết này sẽ hỗ trợ bạn đưa ra quyết định tối ưu."
Vì được vào cấu trúc từ vựng, nó sẽ đi theo đoạn text. Anh em copy ném qua Word, Docs hay lên website thì vết của Claude vẫn y nguyên ở đó.
Nên nếu đọc kĩ thì phát hiện ra nội dung copy-paste sẽ trở nên dễ dàng hơn.
Tuy nhiên vd nếu đoạn văn bản mà claude gen quá ngắn, hệ thống sẽ không có đủ data từ vựng để nhận diện được mẫu thống kê.
Ngoài ra, nếu anh em chỉnh sửa thủ công kĩ đủ nhiều thì cũng ko bị dính Ai, nói chung cái này hên xui.
Cũng cần lưu ý rằng đôi khi ae tự viết một bài 100% nhưng đưa vào AI để check lỗi chính tả, kết quả trả ra vẫn có thể dính watermark.
Do đó, việc dính hình mờ không hoàn toàn đồng nghĩa với việc bài viết đó 100% do AI tự sáng tác.
Quy định này nhằm tuân thủ Đạo luật AI của châu Âu và sẽ bắt buộc áp dụng từ tháng 8 năm 2026.
Watermark này ko phải chỉ mỗi hình ảnh mà các content chữ cũng có watermark nha. Và tất nhiên nhiều anh em chưa hiểu watermark ở content text như nào.
Mình sẽ giải thích ngắn gọn để mọi người dễ hình dung nhất. Cơ chế đánh dấu của Claude hoạt động ra sao?
Hệ thống chia làm hai loại xử lý tùy theo định dạng mà anh em yêu cầu.
Đối với hình ảnh/File (.png, .svg...): Claude sẽ đính kèm Metadata C2PA. Cái này giống như nhãn mác số, quét metadata là ra ngay (dễ hiểu, dễ xóa nếu chụp màn hình hoặc đổi định dạng).
Đối với văn bản, Claude sử dụng kỹ thuật nhúng hình mờ trực tiếp vào câu chữ.
Kỹ thuật này không phải là chèn mã HTML ẩn hay khoảng trắng vô hình để anh em copy qua Notepad là sạch.
Nó can thiệp trực tiếp vào thuật toán chọn từ vựng của AI.
Model sẽ ngầm chia từ vựng thành danh sách ưu tiên và danh sách hạn chế.
Khi gen văn bản, AI sẽ liên tục chọn các từ nằm trong danh sách ưu tiên theo một tỷ lệ cố định. Mắt thường đọc vẫn thấy rất tự nhiên, nhưng tool check của Claude sẽ dễ dàng phát hiện ra dấu vết thống kê này.
- Từ "hỗ trợ" (thay vì "giúp") Nằm trong Green list.
- Từ "quyết định" (thay vì "lựa chọn") - Nằm trong Green list.
- Từ "tối ưu" (thay vì "tốt nhất") - Nằm trong Green list.
Vì được vào cấu trúc từ vựng, nó sẽ đi theo đoạn text. Anh em copy ném qua Word, Docs hay lên website thì vết của Claude vẫn y nguyên ở đó.
Nên nếu đọc kĩ thì phát hiện ra nội dung copy-paste sẽ trở nên dễ dàng hơn.
Tuy nhiên vd nếu đoạn văn bản mà claude gen quá ngắn, hệ thống sẽ không có đủ data từ vựng để nhận diện được mẫu thống kê.
Ngoài ra, nếu anh em chỉnh sửa thủ công kĩ đủ nhiều thì cũng ko bị dính Ai, nói chung cái này hên xui.
Cũng cần lưu ý rằng đôi khi ae tự viết một bài 100% nhưng đưa vào AI để check lỗi chính tả, kết quả trả ra vẫn có thể dính watermark.
Do đó, việc dính hình mờ không hoàn toàn đồng nghĩa với việc bài viết đó 100% do AI tự sáng tác.