Anthropic 宣佈將推出水印檢測 API,允許第三方開發者將 AI 文本檢測功能整合到自己的應用中。該技術基於 Google DeepMind 在 2024 年發表於《自然》雜誌的 SynthID 方法,通過調整選詞時的隨機性來嵌入可追蹤模式,據 Anthropic 稱,這不會影響文本的內容、創意水平或可讀性。
水印在短文本或事實密集的段落中效果較差,因為這類文本可替代的措辭較少;程式碼同樣如此。純人工校正的文本(每個詞都由人選擇)不會攜帶水印,但翻譯文本則不同,因為 Claude 會挑選所有詞彙。重度改寫可能會去除水印,Anthropic 在 FAQ 中承認了這一點。
水印只能標記 Claude 可能參與了文本創作,無法判斷 Claude 是撰寫了全文還是僅進行了大量編輯,也無法判斷文本是否由人類或其他 AI 模型生成。
Anthropic 引入水印是為了遵守歐盟《人工智慧法案》。2026 年 7 月,Anthropic 與約 190 個其他簽署方共同簽署了歐盟關於 AI 生成內容透明度的《實踐準則》。由於目前沒有技術手段按地區限制該功能,水印將在全球範圍啟用。Anthropic 表示,公司正在持續探索更多方案,後續將釋出更新。
所有在 2025 年 8 月 2 日之後釋出的模型均支援水印功能,較舊的 Claude 模型將在未來幾個月內獲得該功能。對於檔案,Anthropic 採用開放的 C2PA 標準,該標準在不改變檔案本身的情況下附加後設資料。
Anthropic 的水印技術與外部 AI 檢測工具(如 Pangram)不同。後者無法訪問 Anthropic 的金鑰,而是通過掃描 AI 文本的典型模式(如慣用措辭或過度使用的詞彙)來檢測。檢查水印是一種根本不同的方法,在實踐中應更可靠。