Текстовый водяной знак Anthropic — это версия техники SynthID-Text от Google DeepMind, впервые опубликованной в рецензируемом журнале Nature в 2024 году . В отличие от видимых водяных знаков или скрытых метаданных, SynthID-Text работает исключительно через статистическое распределение выбора слов.
Когда Claude генерирует текст, он часто сталкивается с несколькими одинаково разумными кандидатами на следующее слово — например, выбирая между «nonсмурно» и «серо» после фразы «Погода сегодня была холодной и...» . Обычно этот выбор решается генератором случайных чисел. При использовании водяного знака случайность заменяется на секретный ключ в сочетании с несколькими предыдущими словами, создавая воспроизводимый, но невидимый паттерн выбора синонимов Claude
.
Ключевые свойства водяного знака:
Anthropic заявляет прямо: «Водяной знак не влияет на качество вывода Claude» . Компания сообщает, что разница между маркированным и немаркированным текстом неразличима для читателей и не оказывает никакого влияния на содержание, креативность или читаемость
.
Эти утверждения подтверждаются исследованием SynthID-Text от Google DeepMind. В ходе A/B-теста на реальном трафике Gemini оценки «палец вверх/вниз» не показали статистически значимых различий по сравнению с немаркированной моделью, а контролируемое исследование с участием людей также не выявило разницы в воспринимаемом качестве . Водяной знак не добавляет затрат и не требует дополнительных токенов при генерации
.
Да, но лёгкость удаления зависит от степени редактирования:
На код водяной знак действует иначе, потому что в коде гораздо меньше «свободных» вариантов выбора слов . Anthropic объясняет, что там, где требуется точный вывод — например, «Самый известный труд Исаака Ньютона называется Principia Mathematica» — есть только одно правильное слово, поэтому у водяного знака нет возможности воздействовать
.
Та же логика применяется к коду: вызовы конкретных функций, синтаксически обязательные ключевые слова и точные названия библиотек не несут сигнала водяного знака. Водяной знак может появляться только в позициях, где существует несколько допустимых токенов, таких как имена переменных, формулировки комментариев или нюансы структуры кода .
Для корректуры или лёгкого редактирования человеческого текста водяной знак аналогично разрежён — он применяется только к словам, которые Claude действительно выбрал, и их может быть слишком мало для обнаружения .
12 августа 2026 года Anthropic подтвердил, что разрабатывает публично вызываемый API обнаружения текста, который позволит сторонним разработчикам проверять, была ли текст, вероятно, сгенерирован Claude . API будет использовать секретный ключ для сравнения паттерна выбора слов с тем, что произвёл бы Claude. По состоянию на 15 августа 2026 года точная дата выпуска не объявлена
.
Anthropic отмечает, что его водяной знак отличается от стилевых ИИ-детекторов (например, Pangram), которые ищут характерные речевые паттерны — проверка водяного знака принципиально отличается от поиска стилистических особенностей .
Реакция на водяной знак оказалась резко поляризованной:
Да. Anthropic заявляет прямо: «Другие крупные разработчики моделей подписали тот же Кодекс практики и будут внедрять собственные водяные знаки» . Инженер Anthropic из команды Claude Code публично заявил, что «это часть работы с EU AI Act, другие лаборатории добавляют аналогичные водяные знаки. Трудно идентифицировать текст, сгенерированный ИИ, и это одно из предложенных решений»
.
Кодекс практики EU AI Act (Статья 50(2)) вступил в силу 2 августа 2026 года и применяется ко всем поставщикам генеративного ИИ, обслуживающим рынок ЕС . Несколько крупных ИИ-компаний подписали тот же кодекс, хотя сроки внедрения различаются
.