Anthropic 宣布未来将对 Claude 生成的文本和图像嵌入机器可读水印,满足欧盟 AI 透明度法规要求,人眼不可见但可被平台检测。
Anthropic 承诺开始为 Claude 生成的文本和图像添加机器可读的水印,以遵守欧盟 AI 透明度规则。"生成的文本将携带嵌入式水印,生成的文件将在支持的情况下包含数字签名的来源元数据,"Anthropic 在一个新的 Claude 支持页面上表示。这些变化对人类肉眼不可见,但将使人们和在线平台更容易检测内容是否由 Claude 模型生成。
这些更新是未来的承诺,而不是立即生效的东西。欧盟 AI 法案于 8 月 2 日生效,其中新的 AI 标注和透明度义务为此前推出的现有 AI 产品提供了四个月的合规宽限期。因此,Anthropic 表示,新的 Claude 模型将从发布第一天起就标记 AI 生成的内容,但对其现有模型的支持仍在进行中。
机器可读标记将全局应用于支持的 Claude 模型,包括 Claude Platform(API)、Claude、Claude Code、Claude Cowork 和 Claude Tag。两种不同的标记技术正在使用中:对于 Claude 处理图像,C2PA——一个已被 Adobe、OpenAI 和 Google 采用的来源元数据标准——将应用于支持的文件,但标记 Claude 生成文本的细节要轻得多。
据 Anthropic 称,一种"难以察觉的水印"直接编织到 Claude 模型生成的文本中,而不会改变聊天机器人回复的含义、质量或可读性。Anthropic 没有透露这个水印系统的名称,但表示这些文本水印在通过 AWS、Google Cloud 或 Microsoft Foundry 访问 Claude 模型时也会被应用。
"因为水印是文本的一部分,当文本被复制粘贴到其他地方时,它会随文本一起传播,并且可能在一些编辑后仍然存在,"Anthropic 在 Claude 支持页面上表示。"水印将在模型级别应用,这意味着无论文本来自哪个 Claude 产品或界面,它都会存在。"
Anthropic 还在努力使客户和其他第三方能够检测嵌入到 Claude 生成内容中的水印和来源元数据,并表示将在即将发布的技术文档中分享关于这个检测系统的详细信息。目前已有多种工具可用于检测 C2PA 元数据,包括 Google 的 Gemini 聊天机器人,但目前尚不清楚这些工具是否能与 Claude 生成的文件配合使用。已向 Anthropic 寻求澄清。
这是朝着 AI 生成的文本和图像在整个在线平台上被清晰标注迈出的又一步,对于希望避免消费此类内容的人来说可能是一场胜利。同人小说读者已经在构建更原始的检测系统,以标记 Claude 工具何时被用于 AO3 同人作品,但这些标记系统可以更广泛地应用——前提是它们有效的话。
已知 C2PA 数据很容易被剥离,有时甚至在携带它的媒体上传到在线平台时意外地被剥离,而且目前尚不清楚 Anthropic 的文本水印解决方案有多强大。即使是该公司本身也在对这些标记系统远非万无一失进行对冲,任何缺乏可检测标记的内容仍可能源自生成式 AI 模型。