Anthropic의 텍스트 워터마크는 2024년 동료 검증을 거친 Nature 저널에 발표된 구글 딥마인드(Google DeepMind)의 SynthID-Text 기술을 기반으로 한 버전입니다 . 눈에 보이는 워터마크나 숨겨진 메타데이터와 달리, SynthID-Text는 단어 선택의 통계적 분포를 통해 전적으로 작동합니다.
Claude가 텍스트를 생성할 때, "The weather today was cold and..."라는 문장 뒤에 "overcast"와 "grey" 중 하나를 선택하는 것처럼, 종종 여러 개의 합리적인 후보 단어에 직면합니다 . 일반적으로 이 선택은 난수 생성기로 결정됩니다. 워터마킹이 적용되면 이 무작위성은 비밀 키(secret key)와 앞에 나온 몇 단어의 조합으로 대체되어, Claude가 선택하는 동의어들 사이에 재현 가능하지만 눈에 보이지 않는 패턴이 생성됩니다
.
워터마크의 주요 특징:
Anthropic은 분명히 밝힙니다: "워터마킹은 Claude 출력의 품질에 영향을 미치지 않습니다" . 회사는 워터마크가 적용된 텍스트와 적용되지 않은 텍스트의 차이가 독자에게 구별 불가능하며, 콘텐츠, 창의성 또는 가독성에 전혀 영향을 미치지 않는다고 보고합니다
.
이러한 주장은 Google DeepMind의 SynthID-Text 연구에 의해 뒷받침됩니다. 해당 연구는 실제 Gemini 트래픽에서 A/B 테스트를 실행했으며, 좋아요/싫어요 평가에서 워터마크가 없는 모델과 통계적으로 유의미한 차이가 없음을 발견했습니다. 또한 통제된 인간 평가자 연구에서도 품질 차이가 인지되지 않았습니다 . 워터마크는 추가 비용이 들지 않으며, 생성 중 추가 토큰이 필요하지 않습니다
.
네, 가능하지만 제거의 용이성은 편집 정도에 따라 다릅니다:
워터마크는 코드에서 선택의 여지가 훨씬 적기 때문에 다르게 작동합니다 . Anthropic은 정확한 출력이 필요한 경우(예: "아이작 뉴턴의 가장 유명한 저작은 프린키피아 Mathematica이다") 정답이 하나뿐이므로 워터마크가 작동할 여지가 없다고 설명합니다
.
동일한 논리가 코드에도 적용됩니다. 특정 함수 호출, 구문상 필수 키워드, 정확한 라이브러리 이름은 워터마크 신호를 전달하지 않습니다. 워터마크는 변수 이름, 주석 문구, 코드 구조의 미묘한 차이 등 여러 유효한 토큰이 존재하는 위치에서만 나타날 수 있습니다 .
Anthropic은 2026년 8월 12일, 제3자 개발자가 텍스트가 Claude에 의해 생성되었는지 확인할 수 있는 공개 호출 가능 텍스트 감지 API를 개발 중이라고 확인했습니다 . 이 API는 비밀 키를 사용하여 단어 선택 패턴을 Claude가 생성할 패턴과 비교합니다. 2026년 8월 15일 기준으로 구체적인 출시일은 발표되지 않았습니다
.
Anthropic은 자체 워터마킹이 특징적인 문구 패턴을 찾는 스타일 기반 AI 감지기(예: Pangram)와는 다르다고 언급합니다. 워터마크를 확인하는 것은 문체적 특징을 찾는 것과 근본적으로 다릅니다 .
워터마킹에 대한 반응은 극명하게 갈렸습니다:
네. Anthropic은 명시적으로 밝힙니다: "다른 주요 모델 개발사들도 동일한 행동 강령에 서명했으며 자체 워터마크를 구현할 것" 입니다 . Claude Code 팀의 Anthropic 엔지니어는 공개적으로 "이는 EU AI 법과 협력하는 과정의 일부이며, 다른 연구소들도 유사한 워터마킹을 추가하고 있습니다. AI 생성 텍스트를 식별하는 것은 어렵고, 이것은 제안된 해결책 중 하나입니다"라고 말했습니다
.
EU AI 법 제50조(2)의 'AI 생성 콘텐츠 투명성에 관한 행동 강령'은 2026년 8월 2일 발효되었으며, EU 시장에 서비스를 제공하는 모든 생성형 AI 제공업체에 적용됩니다 . 여러 주요 AI 기업이 동일한 강령에 서명했지만, 구체적인 출시 일정은 제공업체마다 다릅니다
.