Anthropic 正在為其 AI 助手 Claude 引入文本水印功能,旨在通過統計模式標記 AI 生成的內容,以符合歐盟《人工智慧法案》的要求。然而,這一舉措引發了關於文本質量、法律透明度和規避手段的廣泛討論。

據 Anthropic 介紹,該水印基於 Google 的 SynthID-Text 方法,通過調整文本生成過程中的隨機詞選擇,建立一種可統計檢測的模式,而不會插入可見標記或隱藏字元。公司堅稱,這一技術不會影響內容的創造性或可讀性。

然而,知名科技博主 John Gruber 在 Daring Fireball 上發表長文,對此提出質疑。他認為,沒有兩個同義詞具有完全相同的含義,當 Claude 根據秘密水印金鑰而非語義精確度選擇詞語時,文本質量必然受損。Gruber 指出,系統有時會提高較差詞語的機率並降低最佳詞語的機率,因此 Anthropic 關於差異“難以察覺”的說法是錯誤的。Gruber 自 2002 年起運營 Daring Fireball,並共同創造了 Markdown 格式化語言,該語言現已被許多聊天機器人廣泛使用。

Gruber 還質疑 Anthropic 引用的 Google DeepMind 在《自然》雜誌上發表的 SynthID 研究,認為其測量的點贊/點踩率並不能有效衡量文本質量,因為使用者不會因為模型寫了“香蕉”而非“菠蘿”而給差評。他甚至推測,Gemini 在口碑上不如 Claude 和 ChatGPT 的部分原因可能在於 SynthID 已在其生成過程中發揮作用。

法律行業對此也表現出關注。法律出版物 Artificial Lawyer 分析了水印對律所的影響,總體結論較為寬鬆,認為水印本身無害,大多數情況下客戶和法院不會反對 AI 的使用,甚至有些客戶現在主動要求使用 AI。然而,在特定情境下,問題可能變得棘手:如果客戶明確禁止在案件中使用 AI,或法官對此持懷疑態度,即使提交的檔案在事實上毫無瑕疵,AI 的參與也可能被證明,從而影響訴訟或審判的程序。

此外,水印會隨文本傳播。一份複雜合同可能包含帶有 AI 標記的條款,而其餘部分由人類撰寫。基於舊模板構建的未來合同,若包含 AI 生成的段落,也會繼承這些標記。當使用多個大語言模型時,不同水印甚至可能在同一文件中重疊。

費用談判也可能受到影響。Artificial Lawyer 指出,如果客戶因 AI 使工作更輕鬆而要求折扣,AI 的貢獻在原則上變得可驗證。Anthropic 表示,在事實密集的段落中,由於可替代詞語較少,水印會更為稀疏。對於依賴精確性的法律文本,這是一個相關注意事項,儘管目前尚無相關實證研究。

對於希望去除水印的使用者,可以使用諸如 Declaude 之類的改寫工具。其開發者 James Padolsey 批評歐盟相關法規武斷,認為該系統主要影響普通使用者,而對故意規避行為作用有限。Anthropic 推出水印功能是為了遵守歐盟《人工智慧法案》,但由於無法按地區限制功能,因此在全球範圍內應用。所有在 8 月 2 日之後釋出的 Claude 模型均支援該標記,舊模型將在未來幾個月內進行改造。