Anthropic 上周宣布,为响应欧盟《人工智能法案》最新生效的条款,将强制为所有 Claude 模型生成的文本添加水印,且该政策全球适用,非欧盟用户同样无法选择退出。此举迅速引发全球用户的不满,并催生了专门用于去除水印的开源工具。
根据欧盟《人工智能法案》Article 50(2) 的规定,自 2026 年 8 月 2 日 起,所有提供生成合成音频、图像、视频或文字的 AI 系统,包括通用 AI 系统,必须确保输出结果包含“机器可读的标记”,并能够被检测为 AI 生成或修改的内容。Anthropic 在 7 月签署了欧盟《人工智能生成内容透明度行为准则》后,决定在现有 Claude 模型生成的文字中加入水印,并计划在 8 月 2 日或之后推出的新版本模型中从发布第一天起内置该水印。
此次添加的水印与年初用于标记中国用户的“字符水印”不同,它不再在文本中加入用户无法辨别的字符,而是采用一种“统计水印”技术,参考了谷歌的 SynthID-Text 方案。其原理是:在生成文本时,根据预设密钥,有规律地选择同义词,使足够长的文本形成可被机器识别的特征。例如,描述天气时,Claude 可能倾向于使用“阴沉”、“压抑”、“铅灰色”等特定词汇组合,人类阅读时不会察觉异常,但机器可以据此识别出文本可能由 AI 生成。
Anthropic 在社区公告中强调,水印不会在文本中添加额外内容,也不存在隐藏字符,且不消耗额外 Token,因此不会增加使用成本。同时,水印不携带任何身份信息,无法追溯到具体个人或组织。然而,用户的不满主要源于两点:一是 Anthropic 将欧盟法规要求的合规措施“一刀切”地应用到全球用户,未给非欧盟用户任何选择空间;二是水印的添加不分使用场景,无论是翻译、润色简历还是检查语法,都可能被标记为 AI 内容。
这种“一刀切”的做法引发了关于 AI 内容标记边界的讨论。知名科技分析师 Ben Thompson 尖锐地评论道:“LLM 首先是一种由人使用的工具,如果一个人完成研究、观点和初稿,只让模型润色,把最终作品标记成 AI 内容,就类似于因为文章是用铅笔写的而要求把铅笔列为作者。” 这一观点反映了部分用户的心声:AI 水印不应简单地将所有经过 AI 处理的内容都等同于 AI 生成。
值得注意的是,Anthropic 的水印并非不可破解。消息发布后不久,GitHub 上便出现了专门用于清洗 AI 水印的开源工具,短短五天就获得了超过 1.1 万个星标。更讽刺的是,尽管 Claude 会拒绝安装该工具,但其源码的一部分据称就是由 Claude 自己编写的。此外,还有名为 Declaude 的路由站,可以将文本交给不带水印的模型“洗一遍”,以去除统计水印。
事实上,OpenAI 在 2024 年研究 ChatGPT 文字水印时,就曾因类似技术缺陷而放弃全面部署。OpenAI 当时指出,循环翻译、新模型重写等“全局编辑”手段可以轻松绕过统计水印,且大规模应用后误报率会被放大,影响用户工作流。
行业整体上接受“AI 内容应有标记”的理念,但对 Anthropic 将概率性水印直接与“AI 作品”划等号的做法存在很大抵触。在生成式 AI 已集校对、翻译、编程、研究、重写、共创等能力于一体的当下,“内容由谁创作”已不再是一个简单的水印能回答的问题。Anthropic 此举虽出于合规,但其粗糙的执行方式和“爹味”十足的态度,让用户对其信任度进一步下降。