Anthropic 針對文字和生成的檔案分別採用了不同的技術路線 。
文字浮水印。 當受支援的 Claude 模型產出文字時,它會在 token 序列中直接編織一道難以察覺的訊號 。這個浮水印在正常閱讀時完全看不到,也不會改變回應的意義、品質或可讀性 。這個標記會附著在文字上,當使用者將內容複製貼到其他地方時,浮水印仍然存在,並可透過專門的檢測工具被機器辨識 。
檔案來源憑證。 對於生成的 .svg、.png 和 .jpg 等檔案類型,Claude 會附加經過簽署的 C2PA(Coalition for Content Provenance and Authenticity,內容來源與真實性聯盟)來源憑證 。這道加密簽名嵌入在檔案的元資料中,可以標示該檔案是否經過 Claude 處理,以及檔案是否曾遭竄改 。
雖然這項標記措施直接來自歐盟的法規要求,但 Anthropic 選擇在全球範圍內實施。該公司明確表示:「標記將適用於受支援模型在所有 Claude 服務地區(全球)所產出的內容」。
Anthropic 已明確指出,這些標記並非 AI 來源的決定性證據 。以下幾項根本性的限制,降低了其可靠度:
這項全球部署直接回應了 歐盟 AI 法案第 50 條 的要求,該條款的透明度義務已於 2026 年 8 月 2 日 正式生效 。
第 50 條要求什麼:
生成式 AI 系統的提供者必須確保其產出的內容,都標記有「有效、可靠、穩健且可互通操作的機器可讀標記」,讓這些產出能夠被偵測為 AI 生成或 AI 操縱的內容 。對於部分 AI 生成或操縱的內容,還必須為終端使用者加上清晰可見的標籤 。
這些規則適用於任何在歐盟市場上架或投入使用的 AI 系統——不論提供者設立在何處——賦予該法案域外效力 。違規者可處以最高 1,500 萬歐元,或全球年營業額 3% 的罰款 。
歐盟執委會已於 2026 年 7 月 20 日發布官方指引,並確認「AI 生成內容透明度實務守則」是證明合規的適當途徑 。雖然簽署這份守則是自願性質,但第 50 條的透明度要求本身是強制性的法律義務 。
Anthropic 的合規做法:
Anthropic 選擇在全球範圍內實施標記,這代表 Claude 使用者在世界各地——不只是歐洲——都會看到這些標記 。該公司已簽署歐盟的透明度實務守則,作為第 56 條下的自願合規路徑 。新推出的 Claude 模型從上市即支援標記,舊模型則正在陸續補強 。
對於所有使用 Claude 或接觸其輸出的人來說,這些浮水印增加了一層可追溯性——但不是確定性。實務上,一個有意為之的使用者,只要經過簡單的後處理步驟,就能移除文字浮水印或檔案元資料。這些標記最大的價值,在於作為一種嚇阻手段與基礎合規措施:它們讓一般人更容易辨識出 AI 生成內容,同時又不會干擾正常的閱讀體驗。
從更宏觀的產業角度來看,Anthropic 的這一步,是歐盟 AI 法案下首批大規模部署強制性 AI 內容透明度機制的案例之一。其他 AI 提供者很快也將必須跟進實施類似措施。而 Anthropic 已坦承的這些技術與實務限制,勢必將成為未來關於這些透明度規則究竟有多大的執行力與實用性的核心爭論焦點。