Anthropic 正在为其 AI 助手 Claude 引入文本水印功能,旨在通过统计模式标记 AI 生成的内容,以符合欧盟《人工智能法案》的要求。然而,这一举措引发了关于文本质量、法律透明度和规避手段的广泛讨论。

据 Anthropic 介绍,该水印基于 Google 的 SynthID-Text 方法,通过调整文本生成过程中的随机词选择,创建一种可统计检测的模式,而不会插入可见标记或隐藏字符。公司坚称,这一技术不会影响内容的创造性或可读性。

然而,知名科技博主 John Gruber 在 Daring Fireball 上发表长文,对此提出质疑。他认为,没有两个同义词具有完全相同的含义,当 Claude 根据秘密水印密钥而非语义精确度选择词语时,文本质量必然受损。Gruber 指出,系统有时会提高较差词语的概率并降低最佳词语的概率,因此 Anthropic 关于差异“难以察觉”的说法是错误的。Gruber 自 2002 年起运营 Daring Fireball,并共同创造了 Markdown 格式化语言,该语言现已被许多聊天机器人广泛使用。

Gruber 还质疑 Anthropic 引用的 Google DeepMind 在《自然》杂志上发表的 SynthID 研究,认为其测量的点赞/点踩率并不能有效衡量文本质量,因为用户不会因为模型写了“香蕉”而非“菠萝”而给差评。他甚至推测,Gemini 在口碑上不如 Claude 和 ChatGPT 的部分原因可能在于 SynthID 已在其生成过程中发挥作用。

法律行业对此也表现出关注。法律出版物 Artificial Lawyer 分析了水印对律所的影响,总体结论较为宽松,认为水印本身无害,大多数情况下客户和法院不会反对 AI 的使用,甚至有些客户现在主动要求使用 AI。然而,在特定情境下,问题可能变得棘手:如果客户明确禁止在案件中使用 AI,或法官对此持怀疑态度,即使提交的文件在事实上毫无瑕疵,AI 的参与也可能被证明,从而影响诉讼或审判的进程。

此外,水印会随文本传播。一份复杂合同可能包含带有 AI 标记的条款,而其余部分由人类撰写。基于旧模板构建的未来合同,若包含 AI 生成的段落,也会继承这些标记。当使用多个大语言模型时,不同水印甚至可能在同一文档中重叠。

费用谈判也可能受到影响。Artificial Lawyer 指出,如果客户因 AI 使工作更轻松而要求折扣,AI 的贡献在原则上变得可验证。Anthropic 表示,在事实密集的段落中,由于可替代词语较少,水印会更为稀疏。对于依赖精确性的法律文本,这是一个相关注意事项,尽管目前尚无相关实证研究。

对于希望去除水印的用户,可以使用诸如 Declaude 之类的改写工具。其开发者 James Padolsey 批评欧盟相关法规武断,认为该系统主要影响普通用户,而对故意规避行为作用有限。Anthropic 推出水印功能是为了遵守欧盟《人工智能法案》,但由于无法按地区限制功能,因此在全球范围内应用。所有在 8 月 2 日之后发布的 Claude 模型均支持该标记,旧模型将在未来几个月内进行改造。