Dấu mờ văn bản của Anthropic là một phiên bản của kỹ thuật SynthID-Text của Google DeepMind, được công bố lần đầu trên tạp chí Nature năm 2024 . Không giống như dấu mờ có thể nhìn thấy hoặc siêu dữ liệu ẩn, SynthID-Text hoạt động hoàn toàn thông qua sự phân bố thống kê của các lựa chọn từ ngữ.
Khi Claude tạo văn bản, nó thường phải đối mặt với một số ứng viên tiếp theo hợp lý như nhau — ví dụ, chọn giữa "u ám" và "xám" sau cụm từ "Thời tiết hôm nay thật lạnh và..." . Thông thường, sự lựa chọn này được giải quyết bằng một bộ sinh số ngẫu nhiên. Khi có dấu mờ, tính ngẫu nhiên đó được thay thế bằng một khóa bí mật kết hợp với một vài từ đứng trước, tạo ra một mẫu có thể tái tạo nhưng vô hình trong các từ đồng nghĩa mà Claude chọn
.
Các thuộc tính chính của dấu mờ:
Anthropic khẳng định rõ ràng: "Việc đánh dấu mờ không ảnh hưởng đến chất lượng đầu ra của Claude" . Công ty báo cáo rằng sự khác biệt giữa văn bản có và không có dấu mờ là không thể nhận ra đối với người đọc, và không có ảnh hưởng đến nội dung, tính sáng tạo hay khả năng đọc
.
Những tuyên bố này được hỗ trợ bởi nghiên cứu SynthID-Text của Google DeepMind. Nghiên cứu đó đã tiến hành thử nghiệm A/B trên lưu lượng Gemini thực tế: tỷ lệ đánh giá thích/không thích không cho thấy sự khác biệt có ý nghĩa thống kê nào so với mô hình không được đánh dấu, và một nghiên cứu có kiểm soát với người đánh giá cũng không tìm thấy sự khác biệt về chất lượng cảm nhận . Dấu mờ không làm tăng chi phí và không yêu cầu thêm token nào trong quá trình tạo văn bản
.
Có, nhưng mức độ dễ dàng phụ thuộc vào phạm vi chỉnh sửa:
Dấu mờ hoạt động khác trên mã nguồn vì mã nguồn có ít lựa chọn từ ngữ tùy ý hơn nhiều . Anthropic giải thích rằng ở những nơi cần đầu ra chính xác — chẳng hạn như "Tác phẩm nổi tiếng nhất của Isaac Newton có tên là Principia Mathematica" — chỉ có một từ đúng duy nhất, vì vậy dấu mờ không có gì để tác động
.
Logic tương tự áp dụng cho mã nguồn: các lệnh gọi hàm cụ thể, từ khóa cần thiết về mặt cú pháp và tên thư viện chính xác không mang tín hiệu dấu mờ. Dấu mờ chỉ có thể xuất hiện ở những vị trí có nhiều token hợp lệ tồn tại, chẳng hạn như tên biến, cách diễn đạt bình luận hoặc các sắc thái cấu trúc mã .
Đối với việc dò lỗi hoặc chỉnh sửa nhẹ văn bản của con người, dấu mờ cũng thưa thớt tương tự — nó chỉ áp dụng cho những từ Claude thực sự chọn, có thể quá ít để phát hiện .
Anthropic xác nhận vào ngày 12/8/2026 rằng họ đang phát triển một API phát hiện văn bản có thể gọi công khai cho phép các nhà phát triển bên thứ ba kiểm tra xem văn bản có khả năng được tạo bởi Claude hay không . API sẽ sử dụng khóa bí mật để so sánh mẫu lựa chọn từ ngữ với những gì Claude sẽ tạo ra. Tính đến ngày 15/8/2026, vẫn chưa có ngày phát hành cụ thể nào được công bố
.
Anthropic lưu ý rằng việc đánh dấu mờ của họ khác biệt với các công cụ phát hiện AI dựa trên phong cách (như Pangram) vốn tìm kiếm các mẫu diễn đạt đặc trưng — việc kiểm tra dấu mờ về cơ bản khác với việc tìm kiếm các dấu hiệu văn phong .
Phản ứng đối với việc đánh dấu mờ đã bị chia rẽ sâu sắc:
Có. Anthropic tuyên bố rõ ràng: "Các nhà phát triển mô hình lớn khác đã ký cùng Bộ Quy tắc Thực hành và sẽ triển khai các dấu mờ của riêng họ" . Một kỹ sư của Anthropic trong nhóm Claude Code đã tuyên bố công khai rằng "đây là một phần của việc làm việc với Đạo luật AI EU, các phòng thí nghiệm khác cũng đang thêm đánh dấu mờ tương tự. Thật khó để xác định văn bản do AI tạo ra, và đây là một giải pháp được đề xuất"
.
Điều 50(2) của Đạo luật AI EU có hiệu lực từ ngày 2/8/2026 và áp dụng cho tất cả các nhà cung cấp AI tạo sinh phục vụ thị trường EU . Một số công ty AI lớn đã ký cùng bộ quy tắc, mặc dù lịch trình triển khai cụ thể khác nhau giữa các nhà cung cấp
.