2026 年 8 月 2 日或之後推出嘅 Claude 模型,會喺全球生成文字入面加入肉眼無法察覺嘅統計水印,主要原因係歐盟 AI 法案透明度規定。 水印係藏喺模型揀字嘅統計模式入面,唔係可見標籤或隱藏字元;大幅改寫、翻譯、摘要,或者文字太短,都可能令檢測信心下降。
研究答案

Create a landscape editorial hero image for this Studio Global article: What are Anthropic’s new invisible watermarks for text generated by Claude, why did the company introduce them globally across the API, Clau. Article summary: Anthropic is adding an imperceptible, machine-detectable statistical pattern to new Claude-generated text. It is a provenance signal—not a visible label, hidden character, proof of human misconduct, or proof that Claude . Topic tags: general, general web, education, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, cha
Anthropic 正為較新嘅 Claude 模型加入一種肉眼睇唔到、但機器可以檢測嘅文字水印。公司表示,呢項改動主要係為咗配合歐盟《人工智能法案》(EU AI Act)第 50 條嘅透明度要求;不過,Anthropic 並冇只喺歐洲開啟,而係喺支援嘅 Claude 產品全球採用同一套安排。
最重要嘅限制係:水印檢測結果係來源線索,唔係作者身份判決。 檢測到水印,可以表示 Claude 可能參與產生過部分文字,但唔能夠指出邊個使用咗 Claude、邊個真正寫成篇作品,或者證明整份文件都係 Claude 生成。
2026 年 8 月 2 日或之後推出嘅 Claude 模型,會由推出當日起支援機器可讀標記。Anthropic 亦表示,正研究為較舊模型補上相關功能。標記適用於多個支援 Claude 嘅使用場景,包括 Claude.ai、Claude Platform API、Claude Code、Claude Cowork、Claude Tag,以及部分第三方雲端部署;只要相關功能獲支援,全球各地都可能適用。
當中其實有兩套唔同機制:
呢啲機制唔等於畫面上嘅「AI 生成」標籤、隱藏字元、帳戶識別資料,亦唔係版權聲明。Anthropic 表示,文字水印唔包含可以追溯到特定人士、機構、對話或者聊天內容嘅資料。
Anthropic 所講嘅直接原因,係歐盟 AI 法案第 50 條嘅透明度制度,以及公司承諾遵守第 50(2) 條《AI 生成內容透明度實務守則》。相關要求規定,向歐盟市場提供服務嘅供應商,要令部分 AI 生成內容以機器可讀形式識別。
Anthropic 選擇喺支援嘅 Claude 模型可用嘅地方全面採用,而唔係只為歐盟用戶設一個地區開關。對 API 客戶、企業、開發者同一般用戶嚟講,呢個做法提供一套模型層面嘅全球標準;但唔同平台或者功能,未必支援所有種類嘅標記。
技術核心係模型揀 token 時形成嘅統計模式。語言模型每次續寫句子,通常都有幾個合理選擇;例如某個形容詞可以用幾個意思相近嘅字。水印機制會改變模型處理隨機性嘅方式,喺一啲影響較低嘅選擇上形成由密鑰控制嘅模式。累積足夠多次選擇後,之後就有機會檢測到呢個模式。Anthropic 形容,相關方法同 Google DeepMind 嘅 SynthID-Text 技術方向有關。
對讀者嚟講,輸出文字外觀唔會有明顯分別。系統唔會插入特殊字元,亦唔會增加額外輸出 token;Anthropic 指水印唔應該明顯影響措辭、創意、可讀性或者成本,公司內部測試亦未發現品質受影響。
由於水印係散落喺一般揀字選擇入面,而唔係獨立存在於檔案 metadata,文字經過複製貼上、格式轉換或者部分輕微修改後,仍可能保留足夠模式畀人檢測。不過,呢種持續性係機率性,絕對唔係保證。
唔可以當係可靠保證。 翻譯、摘要、改寫同大幅度編輯,會取代大量原本承載水印嘅 token 選擇。轉換後嘅文字有時可能留低可檢測痕跡,但 Anthropic 嘅說明並唔支持「所有翻譯、摘要、校對或者修改都一定保留水印」呢個講法。
文字太短亦係一個關鍵限制。一般嚟講,可供分析嘅文字越多,檢測信心越高。一段好短嘅回答,或者 Claude 只係幫手改咗幾個字嘅校對工作,可能根本冇足夠 Claude 揀出嘅文字,形成有意義嘅結果。
所以,要分清楚「文字曾經畀 Claude 處理過」同「而家仍然可以驗出水印」係兩回事。驗唔到,唔代表全段一定由人類獨力寫成;驗到,亦唔代表 Claude 寫晒全部內容。
陽性檢測結果只可以回答一條好窄嘅問題:呢段文字有幾大機會曾經由 Claude 參與寫作?
佢唔能夠證明以下任何一點:
水印亦唔會識別特定用戶、機構或者聊天紀錄,而 Anthropic 嘅密鑰亦唔可以用嚟確認其他 AI 供應商嘅輸出。
Anthropic 表示,計劃提供檢測 API。呢種工具同一般靠語氣、文風或者所謂「AI 痕跡」去估作者身份嘅 AI 檢測器唔同;水印檢測器係尋找由特定密鑰製造嘅統計簽名。
爭議焦點係:生成全新合成內容,同提供一般編輯協助,係咪應該一視同仁?批評者擔心,模型層面嘅預設水印可能將一篇由 AI 全面起草嘅文章,同一篇本身主要由人寫、只係用 Claude 幫手改拼字、文法、清晰度、翻譯或者無障礙表達嘅文件,當成同一類問題。
因此,有人形容呢種做法係「大鎚而唔係手術刀」:一套套用於模型所有輸出嘅預設標記,可能比透明度規例原本想處理嘅使用情境更闊。當學校、僱主、出版商或者平台將「驗到水印」直接當成違規證據時,呢個風險尤其明顯。
Anthropic 嘅技術解釋,的確喺部分編輯場景降低咗實際檢測機會:例如輕微校對可能只改動太少文字,未必有足夠統計訊號。但呢個係檢測信心嘅技術限制,唔係面向用戶嘅豁免,亦唔係可靠嘅作者身份測試。
比較呢幾間公司時,要先分開幾個經常混埋一齊嘅概念:
Anthropic 表示,其他主要 AI 供應商亦簽署咗同一份歐盟守則,並會推出各自嘅系統。但呢個唔代表 Google、OpenAI、Meta 同 Microsoft 使用同一種水印方法、涵蓋同一批產品,或者提供完全相同嘅檢測政策。
Anthropic 嘅文字方法同 Google DeepMind 已公開嘅 SynthID-Text 系列有關;C2PA 就係另一套用於支援檔案嘅來源 metadata 機制。按目前提供嘅資料,未足以斷言上述四間公司全部都已經喺文字產品部署同 Claude 一樣、全球適用嘅水印。
政策推出後,有 Claude 用戶擔心 AI 協助會喺學校、職場、出版或者商業場景曝光;亦有報道指部分用戶威脅或者聲稱會取消訂閱。
同時,亦有人研究移除或者規避水印嘅方法。大幅重寫、改寫、翻譯、摘要或者重新生成,都可能削弱甚至消除統計訊號;正因如此,驗唔到水印唔可以替某人證明「完全冇用過 AI」。相反,驗到水印亦可能只反映有限度協助,而唔係整篇內容由 Claude 包辦。
對學校、僱主、出版商同平台嚟講,最穩妥嘅結論好簡單:水印檢測結果應該只係其中一項證據,唔可以自動等同於學術不誠實、抄襲或者其他違規。 作出嚴肅決定前,應該一併考慮文件背景、草稿及版本紀錄、適用嘅披露規則、實際使用咗邊種 AI 協助,以及當事人解釋嘅機會。涉及校對、翻譯、無障礙支援同協作寫作時,人手覆核尤其重要。
Claude 嘅水印或許會令調查 AI 參與變得容易啲,但佢解決唔到更難嘅作者身份問題。真正應該記住嘅分別係:訊號唔等於證明。 水印可以協助透明度,但要判斷作者、責任同有冇違規,始終需要統計標記以外嘅完整背景。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
2026 年 8 月 2 日或之後推出嘅 Claude 模型,會喺全球生成文字入面加入肉眼無法察覺嘅統計水印,主要原因係歐盟 AI 法案透明度規定。
2026 年 8 月 2 日或之後推出嘅 Claude 模型,會喺全球生成文字入面加入肉眼無法察覺嘅統計水印,主要原因係歐盟 AI 法案透明度規定。 水印係藏喺模型揀字嘅統計模式入面,唔係可見標籤或隱藏字元;大幅改寫、翻譯、摘要,或者文字太短,都可能令檢測信心下降。
驗到水印只代表 Claude 可能參與過部分文字嘅產生,唔代表知道邊個寫、AI 寫咗幾多,亦唔代表一定違反學校、公司或平台規則。