Anthropic 上週宣佈,為響應歐盟《人工智慧法案》最新生效的條款,將強制為所有 Claude 模型生成的文本新增水印,且該政策全球適用,非歐盟使用者同樣無法選擇退出。此舉迅速引發全球使用者的不滿,並催生了專門用於去除水印的開源工具。

根據歐盟《人工智慧法案》Article 50(2) 的規定,自 2026 年 8 月 2 日 起,所有提供生成合成音訊、影像、影片或文字的 AI 系統,包括通用 AI 系統,必須確保輸出結果包含“機器可讀的標記”,並能夠被檢測為 AI 生成或修改的內容。Anthropic 在 7 月簽署了歐盟《人工智慧生成內容透明度行為準則》後,決定在現有 Claude 模型生成的文字中加入水印,並計劃在 8 月 2 日或之後推出的新版本模型中從釋出第一天起內建該水印。

此次新增的水印與年初用於標記中國使用者的“字元水印”不同,它不再在文本中加入使用者無法辨別的字元,而是採用一種“統計水印”技術,參考了谷歌的 SynthID-Text 方案。其原理是:在生成文本時,根據預設金鑰,有規律地選擇同義詞,使足夠長的文本形成可被機器識別的特徵。例如,描述天氣時,Claude 可能傾向於使用“陰沉”、“壓抑”、“鉛灰色”等特定詞彙組合,人類閱讀時不會察覺異常,但機器可以據此識別出文本可能由 AI 生成。

Anthropic 在社群公告中強調,水印不會在文本中新增額外內容,也不存在隱藏字元,且不消耗額外 Token,因此不會增加使用成本。同時,水印不攜帶任何身份資訊,無法追溯到具體個人或組織。然而,使用者的不滿主要源於兩點:一是 Anthropic 將歐盟法規要求的合規措施“一刀切”地應用到全球使用者,未給非歐盟使用者任何選擇空間;二是水印的新增不分使用場景,無論是翻譯、潤色簡歷還是檢查語法,都可能被標記為 AI 內容。

這種“一刀切”的做法引發了關於 AI 內容標記邊界的討論。知名科技分析師 Ben Thompson 尖銳地評論道:“LLM 首先是一種由人使用的工具,如果一個人完成研究、觀點和初稿,只讓模型潤色,把最終作品標記成 AI 內容,就類似於因為文章是用鉛筆寫的而要求把鉛筆列為作者。” 這一觀點反映了部分使用者的心聲:AI 水印不應簡單地將所有經過 AI 處理的內容都等同於 AI 生成。

值得注意的是,Anthropic 的水印並非不可破解。訊息釋出後不久,GitHub 上便出現了專門用於清洗 AI 水印的開源工具,短短五天就獲得了超過 1.1 萬個星標。更諷刺的是,儘管 Claude 會拒絕安裝該工具,但其原始碼的一部分據稱就是由 Claude 自己編寫的。此外,還有名為 Declaude 的路由站,可以將文本交給不帶水印的模型“洗一遍”,以去除統計水印。

事實上,OpenAI 在 2024 年研究 ChatGPT 文字水印時,就曾因類似技術缺陷而放棄全面部署。OpenAI 當時指出,迴圈翻譯、新模型重寫等“全域性編輯”手段可以輕鬆繞過統計水印,且大規模應用後誤報率會被放大,影響使用者工作流。

行業整體上接受“AI 內容應有標記”的理念,但對 Anthropic 將機率性水印直接與“AI 作品”劃等號的做法存在很大牴觸。在生成式 AI 已集校對、翻譯、程式設計、研究、重寫、共創等能力於一體的當下,“內容由誰創作”已不再是一個簡單的水印能回答的問題。Anthropic 此舉雖出於合規,但其粗糙的執行方式和“爹味”十足的態度,讓使用者對其信任度進一步下降。