Anthropic 自 2026 年 8 月 2 日起,在全球範圍內,為所有新發布的 Claude 模型在文字輸出中內建了不可見、機器可讀的浮水印。 浮水印有兩層:一層是直接織入文字本身的統計模式;另一層是支援檔案(如 .svg, .png)的數位簽章 C2PA 元數據。
研究答案

Create a landscape editorial hero image for this Studio Global article: How does Anthropic's invisible watermarking system for Claude AI outputs work, what privacy and industry concerns has it raised, and what re. Article summary: ## How the Watermarking System Works. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence.
自 2026 年 8 月 2 日起,Anthropic 在所有新發布的 Claude 模型中,悄悄植入了一道看不見、機器可讀的浮水印。這項全球性措施沒有提供關閉選項,一經推出便引發了關於隱私、著作權與控制權的激烈辯論,隨後也出現了一波宣稱能「移除」浮水印的工具——但到目前為止,這些工具大多未能觸及真正核心的訊號。
Anthropic 採用兩種互補技術來標記 Claude 模型生成的內容。
1. 嵌入式文字浮水印(Embedded Text Watermark) — 在模型推論過程中,直接將一種統計模式織入生成的文字裡。這種模式對人類讀者來說完全不可見,不會改變文字的語意或可讀性,並且在複製、貼上及輕度編輯後依然存在。此標記會套用於所有 Claude 產品的輸出,無論是來自 API、claude.ai、Claude Code,還是第三方雲端供應商
。
2. C2PA 溯源元數據(C2PA Provenance Metadata) — 針對支援的檔案類型(例如 .svg、.png 與 .jpg),Anthropic 會附加經過數位簽章的 C2PA 元數據標籤,用以加密認證該內容是由 Claude 生成。
Anthropic 已簽署歐盟《人工智慧法案》(EU AI Act)第 50(2) 條的行為準則,以遵守關於合成內容標籤的新透明度規範。該公司表示,將很快釋出供使用者與第三方使用的檢測工具。
大規模的反彈聲浪主要集中在以下幾個面向:
無法退出與關閉 — 浮水印直接內建在模型的推論流程中。沒有任何使用者開關、API 參數或企業協議可以將其停用。開發者,尤其是使用 Claude Code 的人,強烈反對在未經同意的情況下,將不可見的元數據注入到他們的輸出中
。
作者歸屬錯誤 — 浮水印在經過校稿或輕度編輯後依然存在。批評者指出,經由人類作者後續修改的文字,仍可能被標記為「AI生成」,這可能會在學術或專業場合導致誤判。
高風險情境下的錯誤指控 — 學生與專業人士在社群媒體上將此舉稱為「一場悲劇」(travesty),擔心自動檢測工具會錯誤地懲罰真正的人類創作。
開發者失去控制權 — 包括 The Browser Company 的 Nick Dobos 在內的知名開發者,基於原則提出了抗議:「我不希望我的程式碼輸出中有看不見的資訊」。
檢測準確性未經驗證 — Anthropic 尚未釋出其檢測器,因此目前無法獨立驗證其誤報率或整體可靠性。
在宣布後數日內,便湧現了一波號稱能「移除浮水印」的工具,但其效果極為有限。
claude-watermark-cleaner (GitHub) — 開發者 mikiane 在24小時內發布。它透過另一個模型對 Claude 的輸出進行一兩次改寫,直到約70%的統計浮水印被削弱。該儲存庫已獲得超過 4,500 顆星。
通用改寫/換句話說工具 — 像 Haimaker 和 Rephrasey 等服務推薦一個三階段流程:清除隱藏的 Unicode 字元、用非 Claude 模型改寫文章、並從檔案中移除 C2PA/EXIF 元數據。
「蛇油」問題 — 來自 BleepingComputer 和 daily.dev 的安全研究人員強調,目前幾乎所有的移除工具都只能移除表層的人工痕跡(隱藏 Unicode 字元、檔案元數據),無法觸及嵌入在字詞選擇中的深層統計浮水印。只有保留語意的完整改寫才有機會削弱它。然而,在 Anthropic 釋出其官方檢測工具之前,沒有任何方法可以可靠地證明浮水印已被移除。
已有的規避服務 — 至少有一家既有的 AI 檢測規避服務也已轉向,宣稱能移除 Claude 浮水印,但在沒有官方檢測器的情況下,獨立驗證依然是不可能的。
核心的緊張關係依然存在:在 Anthropic 釋出公開檢測器之前,沒有任何工具可以可信地證明它已移除了浮水印。這個統計訊號是織入在詞語選擇本身,而不是可移除的附加元數據——而這個區別正是問題的關鍵所在。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Anthropic 自 2026 年 8 月 2 日起,在全球範圍內,為所有新發布的 Claude 模型在文字輸出中內建了不可見、機器可讀的浮水印。
Anthropic 自 2026 年 8 月 2 日起,在全球範圍內,為所有新發布的 Claude 模型在文字輸出中內建了不可見、機器可讀的浮水印。 浮水印有兩層:一層是直接織入文字本身的統計模式;另一層是支援檔案(如 .svg, .png)的數位簽章 C2PA 元數據。
隱私與著作權爭議激烈:開發者批評無法關閉、無法選擇退出;學生與專業人士擔心人工校稿後的文章仍會被標記為「AI生成」,導致誤判。