美国政府指令限制 Fable 5 访问权
Anthropic 就美国政府指令发表声明,称 Fable 5 等模型访问受限。这直接影响程序员的 AI 工具选择和项目规划。
Anthropic 就美国政府指令发表声明,称 Fable 5 等模型访问受限。这直接影响程序员的 AI 工具选择和项目规划。
美国政府以国家安全权限为由,已发出出口管制指令,要求暂停任何外国人(无论身处美国境内还是境外)对 Fable 5 和 Mythos 5 的所有访问,包括 Anthropic 的外籍员工。该指令的直接后果是,我们必须立即为所有客户禁用 Fable 5 和 Mythos 5,以确保合规性。对所有其他 Anthropic 模型的访问不受影响。
我们于今日傍晚 5:21(美国东部时间)收到了政府的指令。信件未提供其国家安全关切的具体细节。据我们理解,政府相信已发现了一种绕过或"越狱" Fable 5 的方法。我们审查了该技术的演示,其被用于识别少量已知的轻微漏洞。这些漏洞看起来都相对简单,我们发现其他公开可用的模型也能在不需要越狱的情况下发现它们。
Anthropic 对 Fable 的安全防护的态度,如我们的发布博客文章中所述,如下所示:
我们已建立了强有力的安全防护措施,大大降低了 Fable 被滥用于与网络安全相关任务的可能性(以及其他方面)。实际上,我们的安全防护措施如此强有力,许多用户抱怨它们过于宽泛。
在 Fable 发布前的几周内,Anthropic 与美国政府、英国 AISI、多个私营第三方组织以及内部团队合作,对 Fable 的安全防护进行了数千小时的总红队测试。
这些测试表明,Fable 的安全防护措施的有效性大大超过了任何以前部署的模型。
到目前为止,没有任何测试人员能够找到通用越狱——一种能够非常广泛地绕过模型安全防护、解锁广泛网络能力的越狱方法。
我们怀疑完美的越狱抵抗能力目前对任何模型提供者来说都是不可能的。业界使用的所有安全防护都容易受到非通用越狱的影响(在特定情况下可能诱发某些网络信息),很可能通用越狱在未来最终会被发现。我们在发布 Fable 5 时已清楚地说明了这一点。
鉴于完美的越狱抵抗能力目前似乎不可能实现,Anthropic 采用了 Fable 5 的纵深防御策略。我们的目标是让越狱要么相对狭窄(非通用越狱的情况),要么生产成本非常高(通用越狱的情况),并将其与彻底的监控相结合,以快速检测和关闭任何成功的攻击。这也是为什么 Anthropic 要求 Fable 的客户数据保留 30 天——这项政策变化对我们与客户的关系造成了真实成本,但它使我们能够研究和缓解越狱。
我们坚持这一纵深防御策略。它降低了 Fable 所带来的风险,使其与业界已部署的现有模型的风险相当。
我们甚至没有收到过导致有害结果的令人关切的非通用潜在越狱的披露。向我们披露的潜在越狱要么是完全良性的回应,要么是只能提供轻微发现、不提供 Mythos 特有优势的发现。
迄今为止,政府仅向我们提供了一个潜在狭窄、非通用越狱的口头证据,其本质上包括要求模型读取特定代码库并修复任何软件缺陷。据我们理解,一个潜在的越狱被分享给了政府。我们审查了一份我们认为是政府指令基础的报告,并验证了其中显示的能力水平在其他模型(包括 OpenAI 的 GPT-5.5)中广泛可用,并被维护系统安全的防御者每天使用。我们将在未来 24 小时内分享更多细节。
我们正在遵守政府的法律指令,为所有用户删除对 Fable 5 和 Mythos 5 的访问。但是,我们不同意发现一个狭窄的潜在越狱应该成为召回部署给数亿人的商业模型的原因。如果这一标准在整个行业应用,我们相信它基本上会阻止所有前沿模型提供者的所有新模型部署。
正如我们公开表示的那样,我们相信政府应该具有阻止不安全部署的能力,作为一个透明、公正、清晰且以技术事实为基础的法定流程的一部分。这一行动不符合这些原则。
我们为对客户造成的这一中断表示道歉。我们相信这是一场误解,正在努力尽快恢复访问。
Cognizant 和 Anthropic 扩展合作伙伴关系,为企业客户提供 Claude
Opus 5 是 Opus 等级的阶跃式进步,为长期运行的 agent 提供支持,同时在编码和专业工作中提供改进。