Anthropic 宣布将推出水印检测 API,允许第三方开发者将 AI 文本检测功能集成到自己的应用中。该技术基于 Google DeepMind 在 2024 年发表于《自然》杂志的 SynthID 方法,通过调整选词时的随机性来嵌入可追踪模式,据 Anthropic 称,这不会影响文本的内容、创意水平或可读性。
水印在短文本或事实密集的段落中效果较差,因为这类文本可替代的措辞较少;代码同样如此。纯人工校正的文本(每个词都由人选择)不会携带水印,但翻译文本则不同,因为 Claude 会挑选所有词汇。重度改写可能会去除水印,Anthropic 在 FAQ 中承认了这一点。
水印只能标记 Claude 可能参与了文本创作,无法判断 Claude 是撰写了全文还是仅进行了大量编辑,也无法判断文本是否由人类或其他 AI 模型生成。
Anthropic 引入水印是为了遵守欧盟《人工智能法案》。2026 年 7 月,Anthropic 与约 190 个其他签署方共同签署了欧盟关于 AI 生成内容透明度的《实践准则》。由于目前没有技术手段按地区限制该功能,水印将在全球范围启用。Anthropic 表示,公司正在持续探索更多方案,后续将发布更新。
所有在 2025 年 8 月 2 日之后发布的模型均支持水印功能,较旧的 Claude 模型将在未来几个月内获得该功能。对于文件,Anthropic 采用开放的 C2PA 标准,该标准在不改变文件本身的情况下附加元数据。
Anthropic 的水印技术与外部 AI 检测工具(如 Pangram)不同。后者无法访问 Anthropic 的密钥,而是通过扫描 AI 文本的典型模式(如惯用措辞或过度使用的词汇)来检测。检查水印是一种根本不同的方法,在实践中应更可靠。