Anthropic针对文本和生成文件使用了不同的技术路线。
文本水印。 当受支持的Claude模型生成文本时,系统会在生成的词汇序列中嵌入一种人眼无法察觉的信号。这种水印在正常阅读时对用户完全不可见,也不会改变回复的含义、质量或可读性。当用户将文本复制粘贴到其他地方时,水印会随文字“旅行”,并且可以通过专门的检测工具由机器识别。
文件溯源元数据。 对于生成的文件类型——具体为.svg、.png和.jpg——Claude会附加经过签名的C2PA(内容来源与真实性联盟)溯源元数据。这个加密签名嵌入在文件的元数据中,可以表明该文件是否由Claude处理过,以及文件是否被篡改过。
虽然水印计划是直接回应欧盟的法规要求,但Anthropic在全球范围内推行。公司声明:“标记将适用于所有提供Claude服务的地区,面向全球用户”。
Anthropic明确表示,这些标记不能作为AI来源的绝对证据。以下根本性限制降低了它们的可靠性:
该部署是针对欧盟AI法案第50条的直接合规回应,其透明度义务已于2026年8月2日正式生效。
第50条要求什么:
生成式AI系统的提供者必须确保其输出带有“有效、可靠、稳健且可互操作的机器可读标记”,使输出能够被检测为AI生成或AI操控。某些AI生成或操控的内容还必须为最终用户提供清晰可见的标签。
这些规则适用于任何在欧盟市场上投放或投入使用的AI系统,无论其提供者位于何处——这赋予了法案域外效力。不合规可能导致高达1500万欧元或全球年营业额3%的罚款(取较高者)。
欧盟委员会于2026年7月20日发布了官方指南,并确认将关于AI生成内容透明度的行为准则作为证明合规的适当途径。尽管遵守该准则属于自愿性质,但第50条下的透明度要求是法律义务。
Anthropic的合规策略:
Anthropic的全球部署意味着所有地区的Claude用户——而不仅仅是欧盟用户——都将看到这些标记。该公司签署了欧盟的透明度行为准则,这构成了第56条下的自愿合规路径。新的Claude模型在发布时即支持标记,旧版模型正在被重新适配。
对于任何使用Claude或接触其输出的用户而言,这些水印增加了一层可追溯性——但这并非绝对确定性。实际情况是,一个有意规避的用户只需进行简单的后续处理,就可以剥离文本水印或文件元数据。这些标记最有效的用途是作为一种威慑和基线合规措施:它们使随意的AI生成内容更容易被识别,同时不会干扰正常的阅读体验。
从更广泛的行业层面来看,Anthropic的举措是欧盟AI法案下首批大规模实施的强制性AI内容透明度措施之一。其他提供者将需要实施类似措施,而Anthropic已经承认的技术和实际局限性,很可能将成为关于这些透明度规则实际可执行性及有用性的持续辩论的核心议题。