Anthropic對文字同生成檔案用咗完全唔同嘅技術方案。
文字水印。 當支援嘅Claude模型生成文字時,系統會喺token序列入面直接織入一種人眼察覺唔到嘅訊號。呢個水印唔會改變閱讀體驗、意思、品質或可讀性。即使用戶將文字複製貼去第二度,個水印都會跟住走,而且可以用專門嘅偵測工具由機器讀取。
檔案源流元數據。 至於生成嘅檔案類型——具體係.svg、.png同.jpg——Claude會附加經C2PA(內容來源與真實性聯盟)簽署嘅源流元數據。呢個加密簽章嵌喺檔案嘅元數據入面,可以話畀你知個檔案係咪俾Claude處理過,同有冇俾人改動過。
雖然水印計劃係直接為咗滿足歐盟要求,但Anthropic係全球推行嘅。「標記會應用於支援模型嘅所有輸出,無論Claude喺邊度提供,全球都一樣,」公司話。
Anthropic明確表示,呢啲標記唔係確定性嘅AI來源證據。有幾個根本限制會降低佢哋嘅可信度:
整個計劃係直接回應歐盟AI法第50條喺2026年8月2日生效嘅透明度規定。
第50條要求啲咩?
生成式AI系統嘅提供者必須確保其輸出帶有「有效、可靠、穩健同可互通嘅機器可讀標記」,令輸出可以被識別為AI生成或篡改。某啲AI生成或篡改內容亦要加上清晰可見嘅標籤。
呢啲規則適用於任何喺歐盟市場推出或投入使用嘅AI系統,唔理提供者基地喺邊度——即係具有域外效力。違規最高可罰1,500萬歐元或全球年營業額嘅3%。
歐盟委員會喺2026年7月20日發布咗官方指引,確認AI生成內容透明度實務守則係展示合規嘅合適方式。雖然遵守守則係自願性質,但第50條嘅透明度規定係法律責任。
Anthropic點樣合規?
Anthropic全球推行意味住所有Claude用戶——唔止歐洲——都會見到呢啲標記。公司簽署咗歐盟嘅透明度實務守則,作為第56條下嘅自願合規途徑。新Claude模型推出即支援標記,舊模型亦逐步更新。
對於任何用Claude或者接觸到Claude輸出嘅人,呢啲水印係多咗一層可追溯性——但唔係確定性。實際情況係,一個決心繞過標記嘅用戶,可以透過簡單嘅後處理步驟刪除文字水印或者檔案元數據。標記最大作用係作為一種阻嚇力同基本合規措施:令日常嘅AI生成內容較容易被識別,同時又唔會影響正常嘅閱讀體驗。
從更廣嘅行業角度睇,Anthropic呢步係喺歐盟AI法下第一批大規模強制AI內容透明度嘅部署。其他提供者都需要推出類似措施,而Anthropic承認嘅技術同實際限制,好大機會會成為將來討論呢啲透明度規則有幾可執行、有幾有用嘅核心議題。