第三方可调用API检测文本是否由Claude生成,基于Google SynthID改进,对事实性文本和代码检测有限制。
Anthropic 即将推出水印检测 API,允许第三方开发者将 AI 文本检测功能集成到自己的应用中。
该公司为其 Claude AI 模型使用了一种 SynthID Text 方法的变体,这是 Google DeepMind 于 2024 年在《Nature》期刊上发表的。水印技术在词汇选择过程中调整随机性来源,创造出一种可追踪的模式。据 Anthropic 称,这不会对"Claude 文本的内容、创造力水平或可读性产生任何影响"。Google DeepMind 在 2024 年用以下动画可视化了这个过程。

水印在短文本或事实密集的段落中效果较差,因为这些地方没有太多可替换的表达方式。代码也是如此。纯校正——人类逐词选择的版本——也不会携带水印。翻译则不同,因为 Claude 在翻译时选择了所有词汇。Anthropic 在发布的 FAQ 中表示,大量改写可能会去除水印。
水印只能标记 Claude 可能参与了文本的创建。它无法判断 Claude 是写了全文还是只做了大量编辑,也无法确定文本来自人类还是其他 AI 模型。
Anthropic 添加水印功能是为了遵守 EU AI Act。该公司与大约 190 个其他签署方一起,于 2026 年 7 月签署了《EU AI 生成内容透明度实践守则》。由于目前没有办法按地区限制该功能,水印将在全球范围内推出。Anthropic 表示,公司正在持续探索更多方案,后续会有更新。
2025 年 8 月 2 日之后发布的所有模型都默认支持水印功能。较旧的 Claude 模型将在未来几个月内获得该功能。对于文件,Anthropic 使用开放的 C2PA 标准,该标准在不改变文件本身的情况下附加元数据。
Anthropic 的水印功能与 Pangram 等外部 AI 检测工具的工作方式不同。这些服务无法访问 Anthropic 的密钥。相反,它们扫描 AI 文本中的典型模式,如惯用措辞或过度使用的词汇。检测水印是一种根本不同的方法,在实践中应该更可靠。
Subscribe to THE DECODER for ad-free reading, a weekly AI newsletter, our exclusive "AI Radar" frontier report six times a year, full archive access, and access to our comment section.