Anthropic从2026年8月起在所有Claude输出文本中嵌入不可见水印并使用C2PA标准签名,检测工具将对第三方开放。
Anthropic 已签署欧盟 AI Act 内容透明度行为准则,并将在 2026 年 8 月起为所有新版 Claude 模型配备机器可读标签。该要求面向全球生效。
文本将嵌入不可见水印,复制时仍可保留。图像等文件将附加遵循 C2PA 标准的签名来源元数据。
Anthropic 承认存在局限:水印并不能证明内容出自 Claude,因为人们经常用 AI 来润色或翻译自己写的东西。重度编辑或格式转换也可能完全去除这些标记;不过水印"可能在一定程度上经历编辑后仍然存留"。
Anthropic 已签署欧盟 AI Act 生成式内容透明度行为准则。从 2026 年 8 月起,新版 Claude 模型将在文本中嵌入水印,并为文件附加数字签名来源元数据。
2026 年 8 月 2 日及之后在欧盟上线的新版 Claude 模型将默认携带此标签。该要求也不会止步于欧盟边界,将适用于全球所有 Claude 产品,包括 API、Claude、Claude Code、Claude Cowork 和 Claude Tag。
生成的文本将携带嵌入水印,生成的文件将获得数字签名来源元数据。现有模型在法律下有过渡期,但 Anthropic 表示已在着手为旧模型补加水印。
公司还计划发布验证工具,供用户和第三方检查标签,但尚未透露具体时间。Anthropic 提示,将 Claude 集成到产品中的开发者需自行判断其服务适用于 Article 50 的哪些要求。
Anthropic 计划采用两类标签。Claude 生成的文本将携带不可见水印,据公司称不影响其含义、质量或可读性。水印在复制粘贴时仍然保留,"可能在一定程度上经历编辑后仍然存留"。水印在模型层面生成,因此使用哪款 Claude 产品均无区别。
支持的文件(包括 .svg、.png、.jpg 图像)将携带基于开放式 C2PA 标准(由内容溯源与真实性联盟制定)的签名来源元数据。该签名表明文件经过 Claude 处理,并能揭示后续的篡改行为。文本水印也应能通过 AWS、Google Cloud 和 Microsoft Foundry 等云合作伙伴生效,不过这些平台可能不支持签名元数据。
Anthropic 对局限性毫不讳言。检测到水印并不意味着 Claude 实际编写了内容。人们经常用 Claude 校对、翻译或总结,因此输出内容可能携带水印而想法实际来自人类。
没有水印也不能说明什么。可能是模型在水印功能推出前发布,文本可能经历了重度编辑或翻译,段落可能太短而无法可靠检测,或者元数据在格式转换或截图过程中被剥离。
真正的考验是这些水印能否在编辑、重新格式化和翻译后存活。如果能的话,检查已知水印应比 Pangram 等工具更可靠——后者专有的检测方法不会揭示触发结果的具体原因。第三方检测器可增加对 Anthropic 水印的支持,从而获得更可靠的信号。
Anthropic 并非孤例。Google Deepmind 开源了 SynthID 水印系统,并将其内置于 Gemini 模型中。SynthID 在 token 预测期间微调概率值来生成水印,而不降低文本质量。它支持多种语言,但难以应对生成后的文本编辑。
OpenAI 手中握有一款准确率达 99.9% 的文本检测器已近两年,但至今仍未发布。原因包括用户可以通过翻译或改写轻易绕过、存在对特定群体污名化的风险,以及很可能担心公开检测器可能损害 OpenAI 自身的商业利益。
这种风险在教育领域尤为严重,不可靠的检测器可能导致虚假的作弊指控。与此同时,想要了解 AI 使用的时间和程度也有充分的理由。研究表明,过度依赖 AI 工具会削弱批判性思维和写作能力,尤其是在将 AI 当作捷径而非学习辅助工具的学生中。问题不止于学术界,如今诈骗者已在美國大学注册虚假学生,用 AI 轻松完成课程作业并骗取助学金。
Anthropic 的这一决定也可能影响其业务。Claude 在知识工作者中很受欢迎,尤其是在中学生和大学生中,因为即使是老版模型也能生成相当自然的文章。随着各大中学和大学已在就学术作业中的 AI 使用问题争论不休,更可靠的检测手段可能使 Claude 对这些用户的吸引力下降。