Các mô hình Claude ra mắt từ ngày 2/8/2026 được gắn watermark thống kê không thể nhìn thấy trong văn bản trên toàn cầu, xuất phát từ yêu cầu minh bạch của Đạo luật AI của Liên minh châu Âu. Watermark được tạo từ cách mô hình lựa chọn token, không phải ký tự ẩn hay siêu dữ liệu; viết lại đáng kể, dịch, tóm tắt hoặc s...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What are Anthropic’s new invisible watermarks for text generated by Claude, why did the company introduce them globally across the API, Clau. Article summary: Anthropic is adding an imperceptible, machine-detectable statistical pattern to new Claude-generated text. It is a provenance signal—not a visible label, hidden character, proof of human misconduct, or proof that Claude . Topic tags: general, general web, education, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, cha
Anthropic đang triển khai watermark vô hình, có thể được máy đọc và phát hiện, cho văn bản do các mô hình Claude mới tạo ra. Công ty cho biết động thái này nhằm hỗ trợ tính minh bạch theo Điều 50 của Đạo luật AI của Liên minh châu Âu (EU AI Act). Tuy nhiên, hệ thống không chỉ áp dụng cho người dùng tại châu Âu mà được triển khai trên toàn cầu ở những sản phẩm Claude được hỗ trợ.
Điểm quan trọng nhất dễ bị hiểu sai là: kết quả phát hiện watermark chỉ là tín hiệu về nguồn gốc, không phải phán quyết về quyền tác giả. Nó có thể cho thấy Claude từng tham gia tạo ra một phần câu chữ, nhưng không thể xác định người dùng, ai thực sự viết tác phẩm hay Claude có tạo ra toàn bộ tài liệu hay không.
Các mô hình Claude ra mắt từ ngày 2/8/2026 được hỗ trợ đánh dấu bằng máy ngay khi phát hành. Anthropic cũng cho biết họ đang tìm cách bổ sung cơ chế này cho các mô hình cũ. Việc đánh dấu được áp dụng trên những nền tảng được hỗ trợ như Claude.ai, Claude Platform API, Claude Code, Claude Cowork, Claude Tag và các dịch vụ đám mây bên thứ ba nơi Claude được cung cấp.
Có hai cơ chế riêng biệt:
Hai cơ chế này không nên bị nhầm với nhãn hiển thị, ký tự ẩn, mã nhận diện tài khoản hay thông báo bản quyền. Anthropic nói watermark trong văn bản không chứa thông tin có thể truy ngược đến một cá nhân, tổ chức, cuộc trò chuyện hay phiên chat cụ thể.
Lý do trước mắt là chế độ minh bạch theo Điều 50 của Đạo luật AI EU, cùng cam kết của Anthropic với Bộ quy tắc thực hành về minh bạch nội dung do AI tạo ra theo Điều 50(2). Các quy định này yêu cầu nhà cung cấp phục vụ thị trường EU đánh dấu một số nội dung do AI tạo ra theo định dạng mà máy có thể nhận diện.
Thay vì tạo một chế độ riêng chỉ dành cho châu Âu, Anthropic chọn áp dụng chính sách ở mọi nơi có các mô hình Claude được hỗ trợ. Cách làm này tạo ra một tiêu chuẩn ở cấp mô hình cho khách hàng API, doanh nghiệp, nhà phát triển và người dùng cá nhân, dù một số nền tảng hoặc tính năng có thể chưa hỗ trợ mọi loại đánh dấu.
Kỹ thuật này dựa trên một mẫu thống kê trong quá trình chọn token. Ở nhiều điểm trong câu, mô hình ngôn ngữ có thể chọn giữa nhiều cách diễn đạt hợp lý. Watermark thay đổi nguồn tạo tính ngẫu nhiên dùng để xử lý một số lựa chọn ít ảnh hưởng đến nội dung, từ đó tạo ra một mẫu được mã hóa và có thể phát hiện sau này. Anthropic mô tả phương pháp này là có liên quan đến kỹ thuật SynthID-Text của Google DeepMind.
Về mặt thị giác, tài liệu không thay đổi. Hệ thống không chèn ký tự đặc biệt, không thêm token vào đầu ra và theo Anthropic không nhằm tạo ảnh hưởng đáng kể đến cách diễn đạt, tính sáng tạo, khả năng đọc hay chi phí. Công ty cũng cho biết các thử nghiệm nội bộ không phát hiện tác động đến chất lượng.
Vì tín hiệu được phân bổ trong những lựa chọn token thông thường, nó khác với siêu dữ liệu tệp — loại thông tin có thể biến mất khi tài liệu được xuất sang định dạng khác hoặc viết lại. Việc sao chép, dán, đổi định dạng hoặc chỉnh sửa nhẹ vẫn có thể giữ lại đủ mẫu để phát hiện. Tuy vậy, khả năng tồn tại này chỉ mang tính xác suất, không phải sự bảo đảm tuyệt đối.
Không phải lúc nào cũng vậy. Dịch, tóm tắt, diễn đạt lại và chỉnh sửa đáng kể sẽ thay thế nhiều lựa chọn token ban đầu — vốn là nơi chứa tín hiệu thống kê. Một đoạn văn sau biến đổi đôi khi vẫn giữ dấu vết có thể phát hiện, nhưng giải thích của Anthropic không đủ để khẳng định mọi bản dịch, bản tóm tắt, lần hiệu đính hay chỉnh sửa đều bảo toàn watermark.
Độ dài đoạn văn cũng là một giới hạn quan trọng. Khi có nhiều văn bản hơn, độ tin cậy của phép phát hiện thường tăng lên. Một câu trả lời ngắn, hoặc một lần hiệu đính mà Claude chỉ thay đổi vài từ, có thể chứa quá ít lựa chọn do Claude tạo ra để cho kết quả đáng tin cậy.
Điều này tạo ra khác biệt giữa việc văn bản từng được Claude xử lý và khả năng phát hiện được watermark. Văn bản có thể đã đi qua Claude nhưng không cho kết quả dương tính rõ ràng; ngược lại, việc không tìm thấy dấu không thể chứng minh đoạn văn hoàn toàn do con người viết.
Một kết quả dương tính chỉ trả lời câu hỏi hẹp hơn: khả năng Claude đã tham gia viết một phần văn bản là bao nhiêu? Nó không chứng minh:
Watermark cũng không thể xác định một người dùng, tổ chức hay cuộc trò chuyện cụ thể. Chìa khóa của Anthropic cũng không thể nhận diện đầu ra đến từ một nhà cung cấp AI khác.
Anthropic cho biết họ dự định cung cấp API phát hiện. Cơ chế này khác với các công cụ phát hiện AI phổ biến, vốn suy đoán tác giả dựa trên đặc điểm ngôn ngữ hoặc những dấu hiệu được cho là “giọng AI”. Bộ phát hiện watermark sẽ tìm một chữ ký thống kê có chủ đích, được tạo bằng một khóa mã hóa.
Tranh luận chính nằm ở sự khác biệt giữa việc tạo ra nội dung tổng hợp mới và hỗ trợ biên tập thông thường. Các ý kiến phê bình cho rằng watermark ở cấp mô hình có thể đối xử như nhau với một bài luận được AI soạn gần như toàn bộ và một văn bản chủ yếu do con người viết nhưng chỉ dùng Claude để sửa chính tả, ngữ pháp, diễn đạt, dịch thuật hoặc hỗ trợ khả năng tiếp cận.
Đó là cơ sở của chỉ trích rằng cách làm này giống “dùng búa tạ thay vì dao mổ”: một dấu mặc định được áp dụng cho mọi đầu ra của mô hình có thể rộng hơn mục tiêu mà các quy định minh bạch hướng đến. Rủi ro đặc biệt đáng chú ý nếu trường học, doanh nghiệp, nhà xuất bản hoặc nền tảng coi sự hiện diện của watermark là bằng chứng về hành vi sai phạm.
Giải thích kỹ thuật của Anthropic phần nào thu hẹp rủi ro trong một số tình huống chỉnh sửa: một lần sửa lỗi nhẹ có thể để lại quá ít từ do Claude lựa chọn để phát hiện chắc chắn. Nhưng đây là giới hạn về độ tin cậy thống kê, không phải ngoại lệ dành cho người dùng và cũng không phải phép kiểm tra quyền tác giả.
Cần tách riêng một số khái niệm thường bị gộp chung:
Anthropic cho biết các nhà cung cấp AI lớn khác cũng đã ký cùng bộ quy tắc của EU và sẽ triển khai hệ thống riêng. Điều đó không có nghĩa Google, OpenAI, Meta và Microsoft sử dụng cùng một phương pháp, bao phủ cùng sản phẩm hay có chính sách phát hiện giống nhau.
Cách đánh dấu văn bản của Anthropic có liên quan đến dòng kỹ thuật SynthID-Text được Google DeepMind công bố, trong khi C2PA được dùng riêng cho siêu dữ liệu nguồn gốc trong các tệp được hỗ trợ. Các nguồn hiện có chưa đủ để kết luận cả bốn công ty nói trên đã triển khai một watermark văn bản toàn cầu tương đương Claude trên các sản phẩm của họ.
Việc triển khai đã làm dấy lên lo ngại trong cộng đồng người dùng Claude rằng việc sử dụng AI có thể bị phát hiện trong môi trường học tập, công sở, xuất bản hoặc kinh doanh. Một số báo cáo cũng ghi nhận người dùng đe dọa hoặc tuyên bố hủy đăng ký dịch vụ vì chính sách này.
Một số người khác tìm cách loại bỏ hoặc né watermark. Việc viết lại đáng kể, diễn đạt lại, dịch, tóm tắt hoặc tạo lại văn bản có thể làm suy yếu hay xóa tín hiệu thống kê — cũng chính là lý do kết quả âm tính không thể “minh oan” cho việc sử dụng AI. Ngược lại, watermark còn tồn tại chỉ có thể phản ánh sự hỗ trợ hạn chế từ Claude, chứ không đồng nghĩa với việc toàn bộ tác phẩm do AI tạo ra.
Với các tổ chức, kết luận an toàn nhất là: kết quả phát hiện watermark chỉ nên là một phần của bằng chứng, không phải căn cứ tự động để kết luận vi phạm. Mọi quyết định nghiêm túc cần xem xét bối cảnh, lịch sử bản nháp và phiên bản, quy định công khai sử dụng AI, loại hỗ trợ đã dùng và cơ hội giải trình của người liên quan. Việc con người thẩm định càng quan trọng trong các trường hợp hiệu đính, dịch thuật, hỗ trợ khả năng tiếp cận và viết cộng tác.
Watermark của Claude có thể giúp việc điều tra khả năng AI tham gia vào một văn bản trở nên dễ hơn, nhưng nó không giải quyết được câu hỏi khó hơn về quyền tác giả. Phân biệt hữu ích nhất là giữa tín hiệu và bằng chứng: tín hiệu có thể hỗ trợ minh bạch, còn bằng chứng kết luận cần bối cảnh mà một dấu thống kê không thể tự cung cấp.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Các mô hình Claude ra mắt từ ngày 2/8/2026 được gắn watermark thống kê không thể nhìn thấy trong văn bản trên toàn cầu, xuất phát từ yêu cầu minh bạch của Đạo luật AI của Liên minh châu Âu.
Các mô hình Claude ra mắt từ ngày 2/8/2026 được gắn watermark thống kê không thể nhìn thấy trong văn bản trên toàn cầu, xuất phát từ yêu cầu minh bạch của Đạo luật AI của Liên minh châu Âu. Watermark được tạo từ cách mô hình lựa chọn token, không phải ký tự ẩn hay siêu dữ liệu; viết lại đáng kể, dịch, tóm tắt hoặc sử dụng đoạn văn quá ngắn có thể làm tín hiệu suy yếu.
Kết quả phát hiện dương tính chỉ cho thấy Claude có thể đã góp phần tạo ra một phần văn bản, không xác định người viết, mức độ sử dụng AI hay việc có vi phạm quy định hay không.