Watermark cho văn bản. Khi một mô hình Claude được hỗ trợ tạo văn bản, nó sẽ dệt tín hiệu watermark vô hình trực tiếp vào chuỗi token . Watermark này vô hình trước mắt người đọc trong quá trình đọc bình thường và không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc của phản hồi
. Điểm đặc biệt là watermark đi cùng với các từ ngay cả khi người dùng sao chép và dán văn bản sang nơi khác và được thiết kế để có thể được phát hiện bởi máy móc thông qua một công cụ phát hiện chuyên dụng
.
Siêu dữ liệu nguồn gốc cho tập tin. Đối với các loại tập tin được tạo ra – cụ thể là .svg, .png và .jpg – Claude đính kèm siêu dữ liệu nguồn gốc C2PA (Coalition for Content Provenance and Authenticity) đã được ký . Chữ ký mật mã này được nhúng trong siêu dữ liệu của tập tin và có thể báo hiệu liệu tập tin đó đã được xử lý bởi Claude hay chưa, cũng như liệu nó có bị can thiệp hay không
.
Mặc dù sáng kiến đánh dấu này là phản ứng trực tiếp với các yêu cầu của EU, Anthropic đang áp dụng nó trên toàn thế giới. Công ty tuyên bố: "Việc đánh dấu sẽ áp dụng cho đầu ra từ các mô hình được hỗ trợ bất cứ nơi nào Claude được cung cấp, trên toàn cầu" .
Anthropic đã tuyên bố rõ ràng rằng những dấu hiệu này không phải là bằng chứng xác thực về nguồn gốc AI . Một số hạn chế cơ bản làm giảm độ tin cậy của chúng:
Việc triển khai này là phản hồi trực tiếp về mặt tuân thủ đối với Điều 50 của EU AI Act, các nghĩa vụ minh bạch của điều này đã có hiệu lực thi hành từ ngày 2 tháng 8 năm 2026 .
Điều 50 yêu cầu những gì:
Các nhà cung cấp hệ thống AI tạo sinh phải đảm bảo đầu ra của họ được đánh dấu bằng "các dấu hiệu đọc được bằng máy hiệu quả, đáng tin cậy, chắc chắn và có khả năng tương tác" cho phép đầu ra được phát hiện là do AI tạo ra hoặc AI can thiệp . Một số nội dung do AI tạo ra hoặc can thiệp cũng phải có nhãn rõ ràng và dễ thấy cho người dùng cuối
.
Các quy định áp dụng cho bất kỳ hệ thống AI nào được đưa ra thị trường hoặc đưa vào sử dụng tại EU, bất kể nhà cung cấp có trụ sở ở đâu – tạo ra hiệu lực ngoài lãnh thổ cho Đạo luật . Việc không tuân thủ có thể bị phạt tới 15 triệu euro hoặc 3% tổng doanh thu hàng năm trên toàn thế giới
.
Ủy ban châu Âu đã công bố các hướng dẫn chính thức vào ngày 20 tháng 7 năm 2026 và xác nhận Bộ Quy tắc Thực hành về Minh bạch của Nội dung do AI Tạo ra (Code of Practice on Transparency of AI-Generated Content) là một phương tiện thích hợp để chứng minh sự tuân thủ . Mặc dù việc tuân thủ Bộ Quy tắc là tự nguyện, nhưng các yêu cầu về minh bạch theo Điều 50 là nghĩa vụ pháp lý
.
Cách tiếp cận tuân thủ của Anthropic:
Việc Anthropic triển khai trên toàn cầu có nghĩa là người dùng Claude ở khắp mọi nơi – không chỉ ở châu Âu – sẽ thấy các dấu hiệu này . Công ty đã ký Bộ Quy tắc Thực hành về Minh bạch của EU, đóng vai trò là lộ trình tuân thủ tự nguyện theo Điều 56
. Các mô hình Claude mới hỗ trợ đánh dấu ngay khi ra mắt và các mô hình cũ hơn đang được trang bị thêm
.
Đối với bất kỳ ai sử dụng Claude hoặc tiếp xúc với đầu ra của nó, các watermark này bổ sung thêm một lớp khả năng truy xuất nguồn gốc – nhưng không phải là sự chắc chắn. Thực tế là một người dùng quyết tâm có thể loại bỏ watermark văn bản hoặc siêu dữ liệu tập tin bằng các bước xử lý hậu kỳ đơn giản. Các dấu hiệu này hữu ích nhất như một biện pháp răn đe và một biện pháp tuân thủ cơ bản: chúng giúp việc xác định nội dung do AI tạo ra một cách thông thường trở nên dễ dàng hơn mà không làm gián đoạn trải nghiệm đọc thông thường.
Ý nghĩa rộng hơn đối với ngành là động thái của Anthropic là một trong những triển khai quy mô lớn đầu tiên về tính minh bạch bắt buộc của nội dung AI theo EU AI Act. Các nhà cung cấp khác sẽ cần thực hiện các biện pháp tương tự và những hạn chế về mặt kỹ thuật và thực tiễn mà Anthropic đã thừa nhận có thể sẽ trở thành trọng tâm của cuộc tranh luận đang diễn ra về mức độ khả thi và hữu ích của các quy tắc minh bạch này.