2. Метадані походження C2PA — Для підтримуваних типів файлів (наприклад, .svg, .png та .jpg) Anthropic додає цифрово підписані теги метаданих C2PA, які криптографічно засвідчують, що контент згенеровано Claude .
Anthropic підписав Кодекс практик ЄС відповідно до статті 50(2) Закону ЄС про штучний інтелект, щоб відповідати новим правилам прозорості щодо маркування синтетичного контенту, і компанія заявила, що незабаром випустить інструменти для виявлення .
Реакція була бурхливою та охопила кілька категорій:
Відсутність можливості відмовитися та вимкнути — Водяний знак вбудований у конвеєр інференції моделі. Не існує жодного перемикача для користувача, параметра API чи корпоративної угоди, яка б його вимикала . Розробники, особливо ті, хто використовує Claude Code, заперечували проти впровадження невидимих метаданих у свій вихідний код без згоди
.
Помилкове приписування авторства — Водяний знак зберігається після вичитки або легкого редагування. Критики стверджують, що текст, пізніше доопрацьований людиною, все одно може позначатися як "згенерований ШІ", що призведе до хибнопозитивних результатів в академічному чи професійному середовищі .
Помилкові звинувачення в чутливих контекстах — Студенти та професіонали заполонили соціальні мережі, називаючи цей крок "ганьбою", побоюючись, що автоматичні інструменти виявлення несправедливо каратимуть леґітимну людську працю .
Втрата контролю розробниками — Відомі розробники, зокрема Нік Добос з The Browser Company, заперечили принципово: "Я не хочу невидимої інформації у своєму вихідному коді" .
Неперевірена точність виявлення — Anthropic ще не випустив свій детектор, тому неможливо незалежно перевірити рівень хибнопозитивних результатів або загальну надійність системи .
Протягом кількох днів після оголошення з'явилася хвиля інструментів для видалення водяних знаків. Їхня ефективність дуже обмежена.
claude-watermark-cleaner (GitHub) — З'явився протягом 24 годин, створений розробником mikiane. Він виконує один або два проходи переписування вихідних даних Claude за допомогою іншої моделі, доки приблизно 70% статистичного водяного знаку не буде ослаблено. Репозиторій зібрав понад 4500 зірок .
Загальні інструменти переписування/перефразування — Сервіси на кшталт Haimaker та Rephrasey рекомендують триетапний процес: видалення прихованих символів Unicode, переписування тексту за допомогою моделі, відмінної від Claude, та видалення метаданих C2PA/EXIF з файлів .
Проблема "зміїної олії" — Дослідники безпеки з BleepingComputer та daily.dev наголошують, що майже всі поточні інструменти для видалення можуть прибрати лише поверхневі артефакти (приховані символи Unicode, метадані файлів), але не глибинний статистичний водяний знак, вбудований у вибір слів. Лише повне переписування із збереженням сенсу має шанс його послабити, і жоден інструмент не може надійно довести, що водяний знак видалено, поки Anthropic не випустить свій детектор .
Існуючі сервіси обходу — Принаймні один існуючий сервіс обходу виявлення ШІ також переорієнтувався на видалення водяних знаків Claude, але незалежна верифікація залишається неможливою без офіційного детектора .
Основна суперечність залишається: без публічного детектора від Anthropic жоден інструмент не може переконливо довести, що він видалив водяний знак. Статистичний сигнал вплетений у сам вибір слів, а не доданий як метадані, які можна видалити — і саме це є ключовим у всій історії.