Znak wodny Anthropica to wersja techniki Google DeepMind SynthID-Text, po raz pierwszy opisanej w recenzowanym artykule w Nature w 2024 roku . W przeciwieństwie do widocznych znaków wodnych czy ukrytych metadanych, SynthID-Text działa wyłącznie poprzez statystyczny rozkład wyborów słów.
Gdy Claude generuje tekst, często staje przed kilkoma równie sensownymi kandydatami na następne słowo – na przykład wybiera między „pochmurno” a „szaro” po zdaniu „Pogoda dzisiaj była zimna i...” . Normalnie wybór ten jest rozstrzygany przez generator liczb losowych. Przy znakowaniu wodnym ta losowość jest zastępowana przez tajny klucz połączony z kilkoma poprzedzającymi słowami, tworząc powtarzalny, ale niewidzialny wzór w doborze synonimów przez Claude’a
.
Kluczowe właściwości znaku wodnego:
Anthropic stwierdza wprost: „Znakowanie wodne nie wpływa na jakość wyników Claude'a” . Firma informuje, że różnica między tekstem ze znakiem a tekstem bez niego jest nierozpoznawalna dla czytelników, bez wpływu na treść, kreatywność czy czytelność
.
Twierdzenia te są poparte badaniami nad SynthID-Text z Google DeepMind. Badanie to przeprowadziło test A/B na żywym ruchu Gemini: oceny pozytywne i negatywne nie wykazały żadnych istotnych statystycznie różnic w porównaniu z modelem bez znaku, a kontrolowane badanie z udziałem ludzi również nie wykazało różnicy w postrzeganej jakości . Znak nie dodaje żadnych kosztów ani dodatkowych tokenów podczas generowania
.
Tak, ale łatwość usunięcia zależy od stopnia edycji:
Znak wodny działa inaczej na kodzie, ponieważ kod ma znacznie mniej wyborów słów o niskiej stawce . Anthropic wyjaśnia, że w przypadku, gdy wymagany jest dokładny wynik – na przykład „Najsłynniejszym dziełem Izaaka Newtona były Principia Mathematica” – istnieje tylko jedno poprawne słowo, więc znak nie ma na czym działać
.
Ta sama logika dotyczy kodu: konkretne wywołania funkcji, wymagane składniowo słowa kluczowe i precyzyjne nazwy bibliotek nie niosą sygnału znaku wodnego. Znak może pojawić się tylko w miejscach, w których istnieje wiele prawidłowych tokenów, takich jak nazwy zmiennych, sformułowania w komentarzach czy niuanse struktury kodu .
W przypadku korekty lub lekkiej edycji tekstu ludzkiego znak wodny jest podobnie rzadki – dotyczy tylko słów, które Claude rzeczywiście wybrał, a tych może być zbyt mało, aby je wykryć .
Anthropic potwierdził 12 sierpnia 2026 roku, że pracuje nad publicznie dostępnym API do wykrywania tekstu, które umożliwi zewnętrznym programistom sprawdzenie, czy tekst został prawdopodobnie wygenerowany przez Claude’a . API będzie używać tajnego klucza do porównania wzorca wyboru słów z tym, co wyprodukowałby Claude. Na dzień 15 sierpnia 2026 roku nie ogłoszono konkretnej daty premiery
.
Anthropic zauważa, że jego znak wodny różni się od wykrywaczy opartych na stylu (takich jak Pangram), które szukają charakterystycznych wzorców frazowania – sprawdzanie znaku wodnego jest zasadniczo inne niż szukanie stylistycznych tropów .
Reakcja na znakowanie wodne jest ostro podzielona:
Tak. Anthropic stwierdza wprost: „Inni główni twórcy modeli podpisali ten sam Kodeks Postępowania i będą wdrażać własne znaki wodne” . Inżynier Anthropica z zespołu Claude Code publicznie oświadczył, że „jest to część współpracy z Aktem o Sztucznej Inteligencji UE, inne laboratoria dodają podobne znakowanie. Trudno jest zidentyfikować tekst wygenerowany przez AI i jest to jedno z proponowanych rozwiązań”
.
Artykuł 50(2) Kodeksu Postępowania Aktu o Sztucznej Inteligencji UE wszedł w życie 2 sierpnia 2026 roku i ma zastosowanie do wszystkich dostawców generatywnej AI obsługujących rynek UE . Kilka głównych firm AI podpisało ten sam kodeks, chociaż konkretne harmonogramy wdrażania różnią się w zależności od dostawcy
.