2. Metadane pochodzenia C2PA – W przypadku obsługiwanych typów plików (takich jak .svg, .png i .jpg) Anthropic dołącza podpisane cyfrowo metadane C2PA, które kryptograficznie potwierdzają, że treść została wygenerowana przez Claude'a .
Anthropic podpisał Kodeks Postępowania EU AI Act (artykuł 50(2)), aby spełnić nowe unijne wymogi przejrzystości dotyczące etykietowania treści syntetycznych, i zapowiedział rychłe udostępnienie narzędzi detekcyjnych .
Reakcje są intensywne i dotyczą kilku obszarów:
Brak możliwości rezygnacji i wyłączenia – Znak wodny jest wbudowany w pipeline wnioskowania modelu. Nie ma przełącznika dla użytkownika, parametru API ani umowy korporacyjnej, która by go wyłączała . Programiści, szczególnie ci używający Claude Code, protestowali przeciwko wstrzykiwaniu niewidzialnych metadanych do ich kodu bez zgody
.
Błędne przypisanie autorstwa – Znak wodny utrzymuje się po korekcie lub lekkiej edycji. Krytycy argumentują, że tekst później poprawiony przez człowieka może być nadal oznaczony jako „wygenerowany przez AI”, co prowadzi do fałszywie pozytywnych wyników w środowisku akademickim lub zawodowym .
Fałszywe oskarżenia w newralgicznych kontekstach – Studenci i profesjonaliści zalali media społecznościowe, nazywając ten ruch „tragedią” i obawiając się, że automatyczne narzędzia detekcyjne niesłusznie ukarzą ich za legalną pracę .
Utrata kontroli przez programistów – Znani programiści, w tym Nick Dobos z The Browser Company, sprzeciwili się z zasady: „Nie chcę w swoim kodzie niewidzialnych informacji, nad którymi nie mam kontroli” .
Niesprawdzona dokładność detekcji – Anthropic nie udostępnił jeszcze swojego detektora, więc niezależna weryfikacja odsetka fałszywych alarmów ani ogólnej niezawodności nie jest możliwa .
W ciągu kilku dni od ogłoszenia pojawiła się fala narzędzi do usuwania znaku wodnego. Ich skuteczność jest mocno ograniczona.
claude-watermark-cleaner (GitHub) – Wysłany w ciągu 24 godzin przez dewelopera mikiane. Wykonuje jeden lub dwa przebiegi przepisywania tekstu za pomocą innego modelu, aż około 70% statystycznego znaku wodnego zostanie osłabione. Repozytorium zdobyło ponad 4500 gwiazdek .
Ogólne narzędzia do parafrazy – Serwisy takie jak Haimaker i Rephrasey zalecają trzyetapowy proces: usunięcie ukrytych znaków Unicode, przepisanie tekstu modelem innym niż Claude i usunięcie metadanych C2PA/EXIF z plików .
Problem „oleju wężowego” – Eksperci ds. bezpieczeństwa z BleepingComputer i daily.dev podkreślają, że niemal wszystkie obecne narzędzia usuwają jedynie powierzchowne artefakty (ukryte znaki Unicode, metadane plików), a nie głęboki statystyczny znak wodny osadzony w doborze słów. Tylko pełne parafrazy zachowujące znaczenie mają szansę go osłabić, ale żadna nie może wiarygodnie udowodnić usunięcia znaku, dopóki Anthropic nie udostępni detektora .
Uznane serwisy do omijania detekcji – Co najmniej jeden istniejący serwis do omijania detekcji AI przestawił się na usuwanie znaku wodnego Claude'a, ale niezależna weryfikacja nadal nie jest możliwa bez oficjalnego detektora .
Podstawowe napięcie pozostaje: bez publicznego detektora Anthropic żadne narzędzie nie może wiarygodnie udowodnić usunięcia znaku. Sygnał statystyczny jest wpleciony w sam dobór słów, a nie dołączony jako usuwalne metadane – i to jest cała historia.