呢次反彈力度好大,仲橫跨幾個範疇:
冇得揀退出,冇得關閉 — 水印直接融入咗個模型嘅推理流程入面。用戶冇得撳掣關閉,API冇參數可以停用,就算簽咗企業合約都冇得豁免。開發者,尤其係用緊Claude Code嗰班,好反對自己嘅輸出被無聲無色咁加入隱形元數據而冇得到佢哋同意
。
消息公布之後冇幾日,市面上就湧現咗一大堆聲稱可以移除水印嘅工具。佢哋嘅效果其實好有限。
claude-watermark-cleaner(GitHub) — 開發者mikiane喺24小時內就發布咗出嚟。佢會用另一個模型對Claude嘅輸出進行一至兩次改寫,大約可以削弱七成嘅統計水印。個repo已經超過4,500粒星。
「蛇油」問題 — BleepingComputer同daily.dev嘅安全研究員強調,目前幾乎所有移除工具都只係可以清除表面嘢(隱藏Unicode字元、檔案元數據),而唔係嗰個內嵌喺用詞選擇入面嘅深層統計水印。只有徹底嘅、保留原意嘅改寫先有機會削弱佢,但喺Anthropic發布偵測工具之前,冇一個工具可以可靠咁證明水印真係已經被移除咗。
核心矛盾好簡單:Anthropic一日唔推出公眾偵測器,就冇任何工具可以令人信服咁證明自己成功移除咗水印。因為呢個統計訊號係直接編織咗入用詞本身,而唔係附加喺檔案入面可以就咁剷走嘅元數據——成個故事嘅關鍵就係呢一點。