Anthropic支持欧盟AI法案的AI生成内容透明度规范,Claude通过两种机制标记:文本中不可见水印(随复制粘贴保留)和C2PA文件溯源元数据。
Anthropic 发布了一篇支持文章,介绍 Claude 如何为 AI 生成内容添加标记,今早登上了 Hacker News 头条。这篇文档本身很短,且大多是技术性的。但讨论却并非如此,因为它触及了大多数使用 AI 的内容团队一直在悄悄回避的问题:当模型处理了你的内容时,是否有一条记录,而保存这条记录又是谁的职责?
以下是目前实际推出的内容、它能证明和不能证明什么,以及需要你来承担的部分。
Anthropic 签署了欧盟 AI 法案第 50(2) 条关于 AI 生成内容透明度的行为准则。2026 年 8 月 2 日或之后在欧盟上线的 Claude 模型在发布时支持机器可读标记,Anthropic 表示正在努力为该日期之前发布的模型添加标记支持。
有两种机制。
文本中难以察觉的水印。Claude 直接将标记嵌入到生成的文本中。读者看不到它,Anthropic 声明它不会改变输出的含义、质量或可读性。因为水印是文本的一部分,所以当文本被复制粘贴时会随之携带,并且经过一些编辑后可能仍然保留。
文件上的 C2PA 签名出处元数据。当 Claude 生成支持的文件类型(包括 .svg、.png 和 .jpg)时,它会遵循内容出处和真实性联盟的开放标准附加签名出处元数据。签名标签表示文件已由 Claude 处理,并允许你检测它是否被篡改。
标记在模型级别应用,因此会跟随模型运行在各种平台上:Claude Platform(API)、Claude、Claude Code、Claude Cowork 和 Claude Tag。通过 AWS、Google Cloud 或 Microsoft Foundry 访问支持的模型时,嵌入的水印也同样适用。Anthropic 明确指出覆盖范围并不统一,签名文件元数据尤其可能在某些平台上不受支持。标记在全球范围内适用,而非仅适用于欧盟用户。检测文档正在编写中。
如果你基于 Claude 构建产品,Anthropic 自己的指导是:你应该独立评估第 50 条对你有什么要求。签署行为准则只覆盖了 Anthropic 的模型。它无法免除你对自己所发布产品的义务。
对于任何运行发布 pipeline 的人来说,文档的局限性部分是最有用的部分,而且 Anthropic 在这方面异常直接。
标记意味着 Claude 处理过该文本。它并不能确定是 Claude 写的。Anthropic 自己举了例子:人们使用 Claude 进行校对、翻译、摘要和文件转换,输出可能携带标记,即使底层想法、文本或数据来自其他地方。任何将检测到的标记作为机器创作证据的政策,都会对你自己的作者产生错误指控。
没有标记什么都证明不了。Anthropic 列出了各种情况:来自标记支持之前发布的模型的内容、经过大量编辑或改写或翻译的文本、过短以至于无法携带可靠信号的段落,以及元数据被剥离的文件。
文件元数据在完全正常的情况下就很脆弱。Anthropic 指出了格式转换、重新保存和截图会剥离 C2PA 元数据。如果你曾经通过优化或调整大小的 pipeline 处理过图片,你可能已经在不知不觉中剥离了出处元数据。在依赖它之前,先验证你的媒体 pipeline 实际保留了哪些内容。
所以诚实的总结:水印是开放互联网的一个有意义的透明度措施,但对你团队内部的记录来说却很弱。检测回答的是"模型是否接触过这个",答案是一个有限定的可能。它无法回答你的团队实际会被问到的问题。
当一篇已发布的文章中的声明被证明是错的,或者客户询问你的文档是如何产生的,或者法务询问你的 AI 披露覆盖了什么时,问题都是具体的:
这些都无法从一个不可见的水印中恢复,即使它被完美检测到。所有这些都可以从你的 CMS 中轻松恢复,前提是你提前决定存储它们。
存在于 Slack 线程、电子表格或某人的记忆中的出处不是出处。将其添加到内容模型中,使其可查询、可报告,而且不可能被跳过。
覆盖上述问题的最小字段集:
ai_assisted:布尔值,是否涉及 AIai_role:枚举,drafted | proofread | translated | summarizedai_model:字符串,使用的模型(例如 claude-sonnet-5-20250514)human_reviewer:字符串,审核人review_date:ISO 日期字符串facts_verified:布尔值,事实是否已核实ai_role 区分是最重要的,因为水印检测根本无法做出这种区分。Claude 从头到尾起草的帖子和 Claude 校对的帖子可能携带相同的标记。你自己的记录将它们区分开来。
使用 Cosmic TypeScript SDK 写入该记录:
npm install @cosmicjs/sdk
import { createBucketClient } from '@cosmicjs/sdk';
const cosmic = createBucketClient({
bucketSlug: 'your-bucket-slug',
readKey: 'your-read-key',
writeKey: 'your-write-key',
});
await cosmic.objects.updateOne('OBJECT_ID', {
metadata: {
ai_assisted: true,
ai_role: 'drafted',
ai_model: 'claude-sonnet-5',
human_reviewer: 'jane-doe',
review_date: '2026-08-11',
facts_verified: true,
},
});
收益在于查询。找出每个未经人工签字的 AI 起草帖子变成了一次请求,而不是一次审计:
const { objects: unreviewed } = await cosmic.objects
.find({
type: 'blog-posts',
'metadata.ai_assisted': true,
'metadata.facts_verified': false,
})
.props('slug,title,metadata.ai_model,metadata.review_date')
.limit(100);
按计划运行这个查询,"我们网站上还有多少未经审核的机器生成内容"就不再是一个猜测。因为这些字段是类型化的并通过 REST API 提供,如果你的披露策略要求,你可以在页面本身上展示相同的记录,而无需维护第二个系统来跟踪它。
实际方面的一个注意事项:在 headless CMS 中,向内容模型添加字段并回填是内容团队的任务,而不是工程工单。FINN 联合创始人 Maximilian Wuhr 简洁地描述了这种安排的价值:
"Cosmic 的意义在于:我们永远不需要让开发人员更改我们网站后端的任何东西。"
出处字段告诉你一篇文章是如何制作的。下一个问题是它的表现如何,以及机器起草的作品在你自己的网站上是否能与人工起草的作品相抗衡。
Cosmic Insights 按创建底层内容的角色将流量汇总,分离出人类用户、Agent 和自动化工具。这将一个哲学争论变成了一个可衡量的问题。如果 Agent 起草的页面跳出率更高或转化率更差,你会在数字中看到它,而不是在会议中争论。如果它们表现相同,那也值得知道。
都不需要重新平台迁移。
**为你的内容模型添加出处字段。**先从上述六个开始。在你需要之前就上线,因为给两年的档案回填出处信息是一场猜谜游戏。
**只回填最近 90 天。**人们正在阅读的内容和会被质疑的内容是最近的。较旧的档案可以诚实地标记为未知。
**测试你的媒体 pipeline 对 C2PA 元数据做了什么。**上传一张 Claude 生成的图片,通过你正常的转换和优化路径运行,检查内容凭证是否保留。假设它们没有保留,直到你验证过。
**用一段话写下你的披露政策。**什么级别的模型参与需要在页面上公开披露?"Claude 起草"和"Claude 校对"是不同的,你的政策应该在读者询问之前就说明这一点。
**将检测排除在你的执行策略之外。**如果你在检查自由职业者或代理商的投稿,将水印命中作为开启对话的理由。Anthropic 自己的文档指出,检测到的标记并非完全确定,因此它本身不能作为政策违规的依据。
**界定你的 Agent 持有的密钥范围。**如果一个 Agent 可以写入生产环境,它留下的出处记录是你拥有的唯一线索。Cosmic 发放独立的读写密钥,因此使用只读密钥连接的客户端获得读取工具,而所有写入工具和全部四个 AI 生成工具都会被阻止,并返回清晰的错误信息。详情见 MCP 服务器页面和将 Claude 连接到你的 CMS。
模型级水印是一个好的发展方向,但它解决的层次对你的目的来说是不对的。它帮助更广泛的互联网大规模识别合成内容。它对必须解释特定页面上的特定段落是如何产生的团队帮助甚微。
这条记录是你自己来保存的,它唯一能可靠存放的地方是在内容本身旁边,作为你可以查询的结构化字段。现在添加这些字段的团队将能够在一个 API 调用中回答出处问题。等以后的团队将不得不从记忆中重建它们,这等于说他们根本无法回答这些问题。
如果你已经在发布工作流程中运行 AI,这是一个下午就能完成的变化,但会产生长期的價值。你可以在 Cosmic 免费计划上建模出处字段,并通过 REST API 今天就开始查询。
免费开始,或预约 15 分钟与我们的 CEO 讨论你的内容模型应如何记录 Agent 工作。
Anthropic, How Claude marks AI-generated content, Claude Help Center
C2PA, Coalition for Content Provenance and Authenticity
最初发布于 Cosmic 博客。