Zapier博客详解Anthropic未发布的Claude Mythos(因安全风险被叫停)与Claude Fable的定位差异:Mythos主打高度自主性但存在严重网络安全威胁,Project Glasswing为替代性安全倡议。
2026 年 4 月 7 日,Claude Mythos Preview 正式发布,但显然其风险过高,不宜公开上线。据 Anthropic 称,Claude Mythos 代表了一种独特的网络安全威胁(他们声称"其后果——对经济、公共安全和国家安全——可能非常严重")。
Anthropic 并未向公众发布 Mythos,而是启动了 Project Glasswing,这是一个网络安全计划,参与者还包括一些知名公司。他们的想法是,在某个中国开源模型发展出相同能力、将整个互联网大门敞开之前,能够将 Mythos 部署用于防御性网络安全目的。
两个月后,Anthropic 发布了一个带有安全护栏的 Mythos 版本——名为 Fable——并向公众完全开放……大约三天。然后美国政府告知他们需要暂停对所有外国公民的访问,现实中这意味着暂停所有人的访问。直到 6 月 30 日,该暂停令才被解除。
此后,新版模型已陆续发布——现在的 Claude Mythos 5.1 和 Claude Fable 5.1 是 Anthropic 能力最强的模型。它们并非为日常使用设计,而是为软件工程、科学研究、计算机视觉和自动化知识工作等任务中的最高性能而设计。正如 Anthropic 所解释的,任务越漫长、越复杂,Mythos 和 Fable 相对于其他模型的能力优势就越明显。
作为一名科技记者,我独立或同时报道 AI 和安全领域已超过十年。我的判断是:尽管 Anthropic 的声明中存在一定程度的营销成分,但 Mythos 和 Fable 是有史以来发布的 最强大的模型。它们可用期间,几乎跃居所有排行榜榜首,包括 Zapier 的 AutomationBench——该基准测试用真实工作流测试模型。
Claude Mythos 5.1 和 Fable 5.1 是通用大型语言模型(LLM),在编码、推理和基于视觉的任务方面尤为擅长。两者之间唯一有意义的区别在于,Fable 5.1 带有安全护栏,阻止其回答有关网络安全、化学和生物学以及蒸馏(或者说它是如何工作的,以尝试训练更便宜的模型)的查询。Anthropic 估计护栏会在大约 5% 的查询中触发,在这些情况下,它会自动回退到 Opus 5。
Mythos 自 2026 年 4 月 7 日起已可用。当时,Anthropic 声称它对广泛发布来说太危险了,因为它已经发现了"数千个高危漏洞,包括存在于每个主要操作系统和 Web 浏览器中的漏洞"。
这就是为什么 Mythos Preview 被发布给 Project Glasswing 合作伙伴。当时,合作伙伴包括 Amazon、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux Foundation、Microsoft、Nvidia 和 Palo Alto Networks——不过作为更广泛推广的一部分,该团队现在已经扩大。初步结果表明该项目取得了巨大成功。合作伙伴因此发现了并修复了超过 10,000 个高危或严重安全漏洞。虽然事情没有发展成完整的《终结者》剧情,但看起来 Anthropic 的谨慎推出策略是正确的。
Anthropic 还计划在未来几个月内作为可信访问计划的一部分,向科学家发布一个移除生物和化学安全限制的版本,但考虑到之前的暂停经历,我们拭目以待。
顺带一提,在推出 Mythos 5 和 Fable 5(两个模型的第一个带编号版本)时,Anthropic 完全搞乱了自己的模型编号规范。其余三个模型目前分别是 Opus 4.8、Sonnet 5 和 Haiku 4.5。虽然这比 OpenAI 的做法要好,但对于需要追踪这些信息的我来说,实在令人头疼。
评估 Claude Fable 5.1 有多好,有两种视角:
首先看基准测试:Fable 将它们碾碎——5.1 在 Artificial Analysis 上占据第一位置。
它也在 Zapier 的 AutomationBench 上取得了领先地位,该基准测试使用 47 个跨六个业务功能的真实工具,对 AI 模型进行端到端工作流执行测试。每个任务都将一个 agent 投入隔离环境(CRM 记录、收件箱线程、日历等),并带有那种让实际工作变得困难的歧义性。这是 Fable 能够落地到现实世界的有力证据。
你知道吗?每次发布新的主要 AI 模型时,Zapier 都会用它运行 AutomationBench,这是一个开源基准测试,用真实业务工作流测试模型。
在一篇与 Glasswing 发布同时发布的文章中,Anthropic 的网络安全研究人员详细介绍了 Mythos 的网络安全能力。
正如我所说,我写这类内容已经很多年了,他们的总结看起来确实值得关注。在一些最严重的漏洞利用中,在特定情况下,黑客可以使用 Mythos 从网站的未认证访问者摇身一变成为服务器上的管理员。
主要结论是,Mythos 似乎非常擅长发现和利用微妙漏洞。它还能将多个漏洞组合成更强大的攻击。在测试中,它在每个主要操作系统和 Web 浏览器中都发现了"零日"(即未被发现)漏洞——这些漏洞存在多年未被修复。它发现的最古老的漏洞是 OpenBSD 中 90 年代的一个 bug。
Mythos 在这方面明显优于 Opus 4.8 或 Sonnet 5。研究人员对 Mythos 发现的一些漏洞利用进行了深入的技术解释,如果你有技术背景,值得一读。
研究人员强调,Mythos 并非被训练出这些能力的。它们是其编码、推理和自主性方面改进的意外后果。它同样擅长发现和修复漏洞,但现在也足够强大到能利用它们了。
虽然这些信息来自 Mythos Preview 而非 Mythos 5.1,但可以安全地假设其能力只会不断提升。早期 Project Glasswing 的结果也支持他们的说法,合作伙伴在最初几周内发现了超过 10,000 个严重安全漏洞。
我不是生物化学家,所以无法评估关于 Mythos 被用于开发新型病毒和生化武器的担忧是否夸大,但 AI 模型已在药物开发、蛋白质折叠和其他相关领域展现出巨大潜力,所以我不会轻易排除这种可能性。还有一种担忧是,通过降低准入门槛,它们基本上会让不良行为者能够" vibe-compound"危险化学品。
我不认为 Mythos 5.1 会带来 AI 末日,但确实有充分的论据认为它需要更强大的护栏才能供公众使用。美国政府的临时出口管制很好地证明了这一点。值得注意的是,Anthropic 声称故意将护栏设置得较高,目的是在收集更多数据后减少未来的误报数量。
Fable 5.1 对 Claude Pro、Max、Team 和部分 Enterprise 订阅者开放,可通过 Claude 应用、Claude 网页应用和 Claude Code CLI 访问——也可以通过 API 访问(不过价格为每百万输入 token 10 美元,每百万输出 token 50 美元,是 Opus 4.8 的两倍)。
如果你在 Zapier 上使用自己的 API 密钥访问 Fable 5.1,可以将其能力添加到所有现有工作流中。在需要的地方放置一个 AI 步骤,其余的交给确定性自动化——不会消耗大量 token。或者你可以使用 Zapier 的 AI 功能来自动化其他 Claude 模型,无需 API 密钥,甚至不需要 Anthropic 账户。
借助 Zapier MCP,你可以更进一步,让 Claude 获得对你整个技术栈中工具和上下文的结构化访问,从而采取行动。这意味着将 Claude 从一个智能助手转变为你系统的 active 部分,从聊天窗口直接触发工作流、更新记录和编排多步骤流程,安全且规模化地运作。了解更多关于如何将 Zapier MCP 与 Claude 结合使用的信息。
本文最初于 2026 年 4 月发布。最近一次更新于 2026 年 9 月。