Claude采用Google DeepMind开源的SynthID-Text方法,通过词汇概率生成可检测模式,并支持C2PA图像标记,以符合欧盟AI法案要求。
Anthropic 已澄清其计划如何对 Claude 生成的文本应用不可见水印,以符合欧洲的 AI 透明度规则。上周五,Anthropic 宣布 Claude 的文本标记系统“是 SynthID-Text 方案的一个版本”——这是 Google DeepMind 开发的一种开源水印技术,通过词汇概率创建可检测的模式。
这项水印功能与 Claude 处理图像的 C2PA 支持一同推出,旨在履行 Anthropic 在欧盟《AI 法案》下的义务。该法案要求合成音频、图像、视频和文本包含机器可读的标记,使内容能够被检测为人工生成或被人为操纵。Anthropic 表示,文本水印不会增加用户使用 Claude 的成本,也不会“对 Claude 输出的质量或内容产生任何实际影响”。以下是 Anthropic 对其工作原理的解释:
以句子"The weather today was cold and…"为例。下一个词是"sugary"的可能性极低。但它很可能是"overcast"或"grey"。在大多数情况下,模型最终选择这两个词中的哪一个对读者来说并不重要——无论选哪个,句子的含义基本相同。在这种情况下,选择由随机数决定。
水印利用生成文本中反复出现的低风险选择,在 Claude 的回复中留下一种模式。这种模式对读者不可见,但任何拥有编码它的密钥的人都可以检测到。当使用水印时,选择仍然是随机做出的,但随机性的来源不同。水印不使用任意随机数生成器来选择下一个词,而是使用密钥和前面的几个词来决定模型应该选择哪个词。
正如 Anthropic 所指出的,欧盟的 AI 透明度要求也影响了其他主要 AI 开发商,所以 Claude 不是唯一引入文本水印的模型。Google 的 Gemini 聊天机器人自 2024 年起已支持 SynthID-Text 解决方案,而虽然 OpenAI 在其 AI 法案合规路线图中没有详细说明 ChatGPT 的任何文本水印计划,但它也将受到该法律要求的约束。