Anthropic发布企业 Frontier Safeguards,监控数据存储在客户自有云账户,密钥和审查权归客户,检测仍由Anthropic自动化运行。
企业 AI 买家一直被困在两个同样不可或缺的需求之间。受监管团队需要零数据保留(ZDR)保证,确保没有任何 prompt 或 agent 对话记录留在供应商的服务器上。而安全团队需要滥用检测,这在历史上要求供应商保留这些数据足够长的时间以进行关联分析。
本周,Anthropic 发布了 Enterprise Frontier Safeguards(EFS),这是一种试图同时满足双方需求的架构。EFS 将监控数据存储在客户控制的云基础设施中,而非 Anthropic 的服务器上。检测能力由 Anthropic 保留,而数据保管、密钥管理和人工审核权则留给客户。
现在可以部署了吗?还不能。EFS 将分阶段推出,目标是今年秋季广泛可用,且采用申请接入制。在正式发布前,符合条件的客户可以在 ZDR 模式下运行 Claude Fable 5 和 Fable 5.1。
Anthropic 公开的数据保留理由是检测质量,而非训练数据。公司从 Fable 5 开始引入 30 天数据保留政策,并明确表示从未在未经明确许可的情况下对企业数据进行训练。
数据保留的论证范围很窄,但值得重申。Anthropic 观察到的最复杂滥用行为会跨多个任务、会话和账户传播,包括涉及被盗或滥用企业凭证的情况。在每次交互中运行自动化分类器并立即丢弃,无法捕捉这种攻击形态。关联分析需要一个时间窗口。Anthropic 在其反间谍工作中已记录了这种模式。
受监管的客户理解安全逻辑,但仍然无法采纳。因此 Anthropic 移动了窗口,而非移除它。
Anthropic 与 100 多家客户共同构建了 EFS,这些客户涵盖金融服务、医疗保健、制造业、电信、法律、零售和公共部门,并与 AWS、Google Cloud 和 Microsoft Azure 合作。贡献者包括系统风险分析与韧性中心(Analysis and Resilience Center for Systemic Risk),其成员包括高盛、摩根士丹利、花旗、美国银行和富国银行的 CISO,以及 Comcast、毕马威、万事达、Salesforce 和 Visa 的团队。Anthropic 表示,设计讨论涵盖了财富 100 强中四分之一的企业和每一家美国全球系统重要性银行。
这一过程产生了三个设计决策:
存储转移至客户:用于监控的活动数据可以存放在客户自己的云账户中,由客户的加密密钥、访问策略和审计日志控制。企业告诉 Anthropic,引入另一个可信数据供应商会触发客户通知和合同更新,因此该架构避免创建新的数据供应商。
审核转移至客户:当监控检测到值得关注的模式时,信号直接发送给客户。Anthropic 的立场是自动化审核处理扫描工作;而人工仍能在确认真实滥用和清除误报时提供价值,在受监管环境中,处理特权法律材料、非公开信息或药物安全报告的人员必须获得相应授权。EFS 运行自动化安全监控,无需 Anthropic 人工审核。
检测由 Anthropic 保留:自动化系统分析流量的滚动窗口以发现严重滥用行为,特别是尝试构建攻击性网络或生物能力的行为,以及凭证被盗或泄露的迹象。
EFS 是随 Claude Fable 5.1 和 Mythos 5.1 一同发布的三大企业级改进之一。另外两个是定价和精度。Fable 5.1 将缓存读取成本降低了 75%,降至每百万 token 0.25 美元,这在典型工作负载下相当于成本降低约 25%,在高度 agent 化的工作负载下最高可达约 45%。其网络安全防护现在在每个 Claude Code 会话中产生的干预次数比 Fable 5 少约 60%,部分原因是 Fable 5.1 被允许识别软件漏洞而不必为此开发漏洞利用代码。
EFS 将相当于 ZDR 的隐私保护与跨会话和账户的自动化检测相结合。