当 Claude 生成文本时,它常常面临多个同样合理的候选词——例如,在输出“The weather today was cold and...”之后,需要在“overcast”和“grey”之间做出选择 。通常,这种选择由随机数生成器解决。而在水印机制下,该随机性被替换为一个 秘密密钥与前文几个词的组合,从而在 Claude 选择的同义词中创造出一种可复现但无形的模式
。
水印的关键特性:
这些说法得到了 Google DeepMind 的 SynthID-Text 研究的支持。该研究在 Gemini 的实时流量上进行了 A/B 测试:赞/踩评级显示 与无水印模型无统计上的显著差异,一项受控的人工评估研究也未发现任何感知到的质量差异 。水印不增加任何成本,也无需在生成过程中使用额外令牌
。
可以,但移除的难易程度取决于编辑的深度:
水印在代码上的工作方式不同,因为代码中 几乎不存在低风险的词选抉择 。Anthropic 解释道,在需要精确输出的地方——例如“艾萨克·牛顿最著名的著作是《自然哲学的数学原理》”——只有一个正确的词,因此水印无从作用
。
Anthropic 于 2026 年 8 月 12 日确认,正在开发一个 可公开调用的文本检测 API,使第三方开发者能够检查某段文本是否可能由 Claude 生成 。该 API 将使用秘密密钥将词选模式与 Claude 可能产生的结果进行比较。截至 2026 年 8 月 15 日,尚未公布具体的发布日期
。
对水印政策的反应出现了严重分化:
是的。Anthropic 明确表示:“其他主要模型开发商也已签署同一行为准则,并将实施自己的水印方案” 。Anthropic Claude Code 团队的一名工程师公开指出,“这是与欧盟 AI 法案合作的一部分,其他实验室也在增加类似的水印功能。识别 AI 生成的文本很困难,而这是一个提议的解决方案”
。
欧盟 AI 法案第 50(2) 条实践准则于 2026 年 8 月 2 日生效,适用于所有服务欧盟市场的生成式 AI 提供商 。多家主要 AI 公司已签署同一准则,但各提供商的具体推出时间表有所不同
。