由 2026 年 8 月 2 日起推出嘅 Claude 新模型,會喺生成文字入面加入肉眼睇唔到嘅統計式水印;支援嘅檔案格式就會加入數碼簽署嘅來源資料。 Anthropic 表示,水印唔包含任何可以識別個人、機構或者對話嘅資料。 移除工具好快引起關注:其中一個 GitHub 專案三日內吸引約 8,983 粒 stars,但呢個數字只反映人氣,唔代表已證實可以成功破解 Claude 未公開嘅統計式水印。
研究答案

Create a landscape editorial hero image for this Studio Global article: What happened after Anthropic began embedding a statistical watermark in all Claude-generated text and files worldwide on August 2, 2026 to. Article summary: The rollout triggered an immediate, mostly symbolic arms race: Anthropic’s mark is designed as a probabilistic signal of Claude involvement, while developers rapidly published tools claiming to erase it. But there is no . Topic tags: general, general web, user generated, government, academic. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Claude 新增嘅隱形水印,最準確嘅理解係一條內容來源線索,而唔係一個可以證明「邊個寫」嘅數碼簽名。
由 2026 年 8 月 2 日起推出嘅 Claude 模型,會喺生成文字時加入肉眼無法察覺嘅統計模式;至於部分支援嘅檔案,就會附帶數碼簽署嘅來源資料。Anthropic 因應歐盟《人工智能法案》(EU AI Act)嘅透明度要求,將安排套用到全球,而唔係只限歐洲用戶。
消息公布後,開源及瀏覽器工具幾乎即刻湧現,聲稱可以清走 AI 痕跡。不過最關鍵、亦最容易畀人忽略嘅一點係:Anthropic 暫時未公開完整技術規格,亦未提供一個公眾可以獨立測試嘅官方偵測器。因此,外界未有足夠條件驗證某個工具係咪真係成功擊破 Claude 水印。
文字水印係喺生成過程入面融入內容。佢唔會變成可見標籤、額外一句聲明,亦唔係簡單咁塞入零寬字元或者其他隱藏字元。
相反,模型會輕微調整揀字嘅機率,令整段文字嘅用字分布可以透過統計方式分析。Anthropic 指出,設計目標係唔改變回應嘅意思、質素或者可讀性。
對於部分支援格式,包括 SVG、PNG 同 JPG,系統會加入數碼簽署嘅來源 metadata。呢個機制同文字水印唔一樣:metadata 可以提供一份結構化嘅素材來源紀錄;文字水印就係直接藏喺語言本身嘅生成模式入面。
2026 年 8 月 2 日或之後推出嘅新 Claude 模型,據 Anthropic 所講會由推出第一日開始支援標記;較早推出嘅模型就會喺過渡期內逐步加上相關功能。所以,有冇水印可能視乎你用緊邊個模型,同埋輸出係文字定檔案。
Anthropic 表示,水印唔包含任何身份資料,亦唔可以追溯到特定人士、機構或者對話。 換句話講,偵測到正面訊號,唔等於有一份用戶身份紀錄,更加唔等於可以還原當初嘅 prompt 或完整對話。
水印更唔能夠單靠自己解答「作者係邊個」呢個問題。就算偵測到 Claude 嘅訊號,最多只可以提示 Claude 可能參與過內容嘅生成或者加工,並唔能夠證明:
呢個分別好重要。現實中嘅 AI 輔助創作,往往唔係「人寫」或者「AI 寫」咁二元:有人可能叫 Claude 起草,再逐段大改;有人會將 Claude 草稿同自己採訪得返嚟嘅資料混合;亦有人只係用 Claude 執字、校對或者整理結構。
所以,水印可以協助分析來源,但唔可以單獨將最終作品定性為「完全由 AI 撰寫」或者「完全由人類撰寫」。
《人工智能法案》第 50 條要求生成式 AI 系統供應商,為 AI 生成或者經 AI 操作嘅內容加入機器可讀標記,令系統可以偵測內容係由 AI 生成或者修改。涵蓋範圍包括合成文字、聲音、圖片同影片。
Anthropic 選擇喺模型層面全球推出,而唔係整一個只限歐盟嘅開關。相關報道指,原因部分同產品及部署渠道眾多有關,要長期維持一條可靠嘅地區界線並唔容易。 實際效果係,即使用戶身處歐盟以外,都可能遇到帶標記嘅 Claude 輸出。
法例規定嘅係結果——標記要有效、可靠、穩健,而且具互操作性——而唔係指定某一種水印技術。法例冇要求所有供應商使用同一種統計方法、metadata 標準或者可見標籤。
早期最受注目嘅項目之一,係 Guillaume Meyer 推出、採用 MIT 授權嘅 watermarks-remover。項目儲存庫聲稱可以處理用戶自己擁有嘅文字及檔案,清除隱藏 Unicode 字元、metadata 等來源標記,亦提供以重寫方式處理內容嘅功能。
之後亦有其他項目出現,包括 claude-watermark-cleaner 儲存庫,以及聲稱可以清理文件同其他格式內隱藏 AI 標記嘅瀏覽器工具。
其中一個儲存庫據報喺三日內升至 8,983 粒 GitHub stars。呢個數字確實反映公眾關注度,但唔係水印移除準確度嘅測試結果。
尤其係,清除零寬字元或者檔案 metadata,未必會影響藏喺揀字分布入面嘅統計訊號。換句話講,工具可能只係清走咗另一層「表面痕跡」,並唔代表已經處理到 Claude 嘅文字水印。
統計式文字水印唔係貼咗喺文件表面、永遠跟住文件走嘅固定標籤。佢能唔能夠被偵測,取決於原本模型嘅用字模式,有幾多喺後續處理後保留低。
一般複製、貼上、重新排版,或者輕微編輯,可能仍然保留足夠模式;但翻譯、改寫、意譯、大幅編輯,或者混入大量人手撰寫內容,就可能令訊號減弱甚至消失。Anthropic 自己亦承認,大幅重寫可以移除相關訊號。
呢度就出現一個驗證難題:如果冇 Anthropic 嘅偵測器同完整技術資料,外界無法可靠判斷某個「清理工具」係:
因此,現階段聲稱某個工具「可以對付 Claude 水印」,應該視為未經證實嘅說法,而唔係已建立嘅技術結果。
限制其實係結構性嘅:只要人可以自由改變語言,依靠推論模式嘅水印就有機會被改變語言本身破壞。提高水印對一般複製或者輕微處理嘅抵抗力,或許可以減少漏檢;但就算再穩健,都唔會將一個可以變動嘅文字訊號變成永遠無法破解嘅完整保管鏈。
第 50 條主要要求相關 AI 系統供應商,並喺指定情況下要求部署者,確保合成輸出帶有機器可讀標記,而且可以被偵測為 AI 生成或者操作內容。條文重點係標記結果同可偵測性,並冇指定全世界統一使用邊一種技術。
歐盟現有指引亦唔等於一條全面、獨立存在嘅禁令,禁止所有第三方移除內容上嘅標記。指引承認,如果係一般編輯,而又冇大幅改變輸入資料或者其語義,相關情況需要放返喺整個標記框架入面理解;但佢冇將水印變成一項技術上永久存在嘅權利。
當然,移除水印唔代表喺任何情況下都一定冇法律後果。合約條款、平台規則、版權問題、防止欺詐及誤導嘅法律、僱傭或學術政策,甚至特定行業嘅披露要求,都可能影響個別個案嘅判斷。
較穩妥嘅結論係:第 50 條嘅供應商標記責任,唔應該被誤解為文字水印必然永久存在;亦唔應該被當成一條可以解決所有下游用途嘅普遍禁令。
Claude 水印喺部分情況下可以令 AI 參與變得較容易被偵測,特別係帶標記文字只經過複製或者輕微編輯,而檔案嘅來源 metadata 又仍然保留。但佢唔能夠單獨證明作者身份、擁有權、責任,或者一個人實際參與創作嘅程度。
移除工具之間嘅競賽,反而更加凸顯呢個分別:一個 GitHub 項目可以喺冇人能夠獨立測試嘅情況下,短時間內吸引幾千粒 stars,人氣唔等於驗證結果。
對出版商、教育機構、企業同平台嚟講,真正值得問嘅唔只係「有冇水印」,而係:
水印可以提供一條線索,但唔係終極答案。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
由 2026 年 8 月 2 日起推出嘅 Claude 新模型,會喺生成文字入面加入肉眼睇唔到嘅統計式水印;支援嘅檔案格式就會加入數碼簽署嘅來源資料。
由 2026 年 8 月 2 日起推出嘅 Claude 新模型,會喺生成文字入面加入肉眼睇唔到嘅統計式水印;支援嘅檔案格式就會加入數碼簽署嘅來源資料。 Anthropic 表示,水印唔包含任何可以識別個人、機構或者對話嘅資料。
移除工具好快引起關注:其中一個 GitHub 專案三日內吸引約 8,983 粒 stars,但呢個數字只反映人氣,唔代表已證實可以成功破解 Claude 未公開嘅統計式水印。