Anthropic 推出 Claude Fable 5,社区热烈讨论(HN 2600+ 赞),直接改变程序员的 AI 编码工具选择和工作方式。
更新
Claude Mythos 5 和 Fable 5 已重新部署
2026 年 7 月 1 日
Claude Fable 5 和 Mythos 5 现已开放使用。
阅读更多
Claude Mythos 5 和 Fable 5 已重新部署
Claude Fable 5 和 Mythos 5 现已开放使用。
Claude Mythos 5 和 Fable 5 暂时无法访问
2026 年 6 月 12 日
我们将暂停 Claude Fable 5 和 Claude Mythos 5 的访问。对于由此给客户带来的不便,我们深表歉意,并正在努力尽快恢复访问。
阅读更多
Claude Mythos 5 和 Fable 5 暂时无法访问
我们将暂停 Claude Fable 5 和 Claude Mythos 5 的访问。对于由此给客户带来的不便,我们深表歉意,并正在努力尽快恢复访问。
今天,我们正式发布 Claude Fable 5:这是一款经过安全处理、可供普通用户使用的 Mythos 级¹模型。
Fable 5 的能力超过了我们以往面向公众提供的所有模型。在几乎所有经过测试的 AI 能力基准中,它都达到了当前最佳水平,并在软件工程、知识工作、视觉、科学研究及诸多其他领域展现出卓越表现。任务越耗时、越复杂,Fable 5 相较于我们其他模型的领先优势就越大。
发布能力如此强大的模型也伴随着风险。如果缺乏安全措施,Fable 5 在网络安全等领域的能力可能会遭到滥用,造成严重损害。因此,我们在发布模型时加入了安全措施:对于某些主题的查询,将改由我们能力仅次于它的模型 Claude Opus 4.8 回答。为了既安全又快速地发布该模型,我们对这些安全措施采取了较为保守的调校方式——它们有时会拦截无害请求,不过平均而言,触发这些措施的会话不到 5%。随着未来几个月能力更强的模型陆续推出,我们正在努力改进安全措施,并尽快减少误报。
我们还面向一小部分网络防御人员和基础设施提供商发布 Claude Mythos 5。它与 Fable 5 使用相同的底层模型,但取消了部分领域的安全限制。² Mythos 5 最初将通过 Project Glasswing 部署,与美国政府展开合作,作为 Claude Mythos Preview 的升级版本。它拥有目前全球所有模型中最强的网络安全能力。我们计划很快通过范围更广的可信访问计划,扩大 Mythos 5 的开放范围。
Fable 5 和 Mythos 5 这类模型的能力,有潜力为世界带来意义深远的积极影响。我们已经在 Project Glasswing 中看到这种潜力初露端倪:这些模型帮助网络防御人员保护极其重要的软件。我们也在生命科学研究中看到了这一点:模型正在提出新颖的假设,并加快新型治疗方法的研发。
Fable 5 和 Mythos 5 的定价为每百万输入 token 10 美元、每百万输出 token 50 美元——不到 Claude Mythos Preview 价格的一半。今天的联合发布,是我们朝着既定目标迈出的又一步:尽可能快速、安全地将先进 AI 能力带给尽可能多的用户。
下表对比了 Fable 5、Mythos 5 与其他领先模型的能力。
Fable 5 和 Mythos 5 能够自主工作的时间比以往任何 Claude 模型都更长。下面我们将讨论这些能力在软件工程中的应用,并介绍模型在知识工作、视觉、记忆和生命科学研究方面得到提升的能力。
软件工程。 在早期测试期间,Stripe 表示,Fable 5 将原本需要数月完成的工程工作压缩到了数天。在一个包含 5,000 万行代码的 Ruby 代码库中,该模型仅用一天就完成了覆盖整个代码库的迁移;如果完全由人工完成,整个团队需要两个多月。Fable 5 的 token 效率也高于以往的 Claude 模型:Cognition 的 FrontierCode 评估旨在测试模型能否在满足高质量生产代码库标准的同时完成高难度编码任务;在该评估中,即使只使用中等推理强度,Fable 5 的得分也位居前沿模型之首。
知识工作。 Fable 5 在复杂分析任务中表现强劲。在 Hebbia 面向高级推理能力的金融基准测试中,Fable 5 获得了所有模型中的最高分,并在基于文档的推理、图表解读和问题解决方面取得了显著提升。IMC 指出,Fable 5 几乎全面通过了其交易分析评估,包括事实查找、概念推理、根因分析和期望值分析。
视觉。 Fable 5 已成为视觉任务方面新的当前最佳模型。它可以从复杂、详尽的科学图表中提取精确数值,也能完成复杂的视觉任务,例如仅根据屏幕截图重建 Web 应用的源代码。它所需的辅助框架也更少:例如,以往的 Claude 模型即使配备了可提供额外实用工具的测试框架,也很难通关《Pokémon FireRed》;而 Fable 5 仅使用最精简的纯视觉测试框架便通关了该游戏。
记忆与长上下文。 在涉及数百万 token 的长时间运行任务中,Fable 5 能够持续保持专注,并利用自己的笔记改进输出。我们让模型游玩牌组构筑游戏《Slay the Spire》时,访问基于持久化文件的记忆为其带来的性能提升是 Opus 4.8 的三倍;Fable 进入游戏最终章节的次数也是后者的三倍。
药物设计: 我们的内部蛋白质设计专家使用 Mythos 5,将药物设计流程中某些环节的速度提高了约 10 倍。在一个案例中,他们发现,当 Mythos 5 配备蛋白质设计和生物信息学工具、但没有人类协助时,其表现可以达到或超过熟练的人类操作人员。模型完成了通常由科学家承担的全部任务:选择结合位点、挑选并运行蛋白质设计工具,以及在过程中从失败中恢复。这项研究涉及的 14 个蛋白质靶点中,有 9 个(如下所示)产生了很有潜力的候选药物设计方案,我们目前正在对此展开研究。
分子生物学领域的新颖假设。 Mythos 5 是我们的首个能够持续提出新颖且有说服力的科学假设的模型。在与 Opus 级模型进行的盲测式正面对比中,我们的科学家约有 80% 的时间更青睐 Mythos 提出的分子生物学假设,并已将其中多个假设推进至实验评估阶段。与此同时,Mythos 提出的一个假设——关于某种大肠杆菌蛋白质的新机制——已得到一家独立研究同一问题的实验室所发表研究的印证。
基因组学领域的原创研究。 Mythos 5 在一周多的时间里以基本自主的方式开展了原创基因组学研究。它汇集了涵盖 138 种动物、数百万个细胞的单细胞数据,并设计和训练了一个定制机器学习模型,用于识别即使在亲缘关系相距甚远的生物体中也承担相同功能的细胞。在仅接受人类高层指导的情况下,Mythos 5 训练出的模型性能超过了近期发表于《Science》期刊的一款模型——尽管其规模小了 100 倍。我们计划在未来几个月内发表这些结果。
对齐。 在自动化对齐评估中,我们发现 Mythos 5 的不对齐行为水平较低,与 Opus 4.8 相近。这些行为包括模型自身采取的不对齐行动,例如欺骗,以及配合用户滥用模型。鉴于 Fable 5 和 Mythos 5 使用相同的底层模型,Fable 5 的对齐水平也会与之相近。模型的系统卡完整介绍了这项评估,以及其他一系列详细的安全性和能力测试。
获得早期访问权限的客户对 Fable 5 进行了自己的测试。以下是他们以自己的话描述的部分观察结果:
Mythos 级模型已经达到一个会带来重大风险的能力门槛。今年 4 月,我们启动了 Project Glasswing,仅向一小部分网络防御人员和关键软件基础设施提供商发布首个 Mythos 级模型 Claude Mythos Preview。当时我们曾表示,只要能够开发出足够强大、可以可靠防止滥用的新安全措施,我们希望最终向所有用户开放 Mythos 级能力。
过去几个月里,我们一直在改进这些安全措施,目前它们已经足够稳健,可以支持全面发布。由于我们将安全放在首位,因此有意对安全措施采取了谨慎的调校方式,其严格程度仍高于理想水平——例如,有时无害请求也会触发我们的分类器。我们意识到这会令部分用户感到沮丧;我们的目标是在发布后持续更新和完善这些安全措施,以减少误报。
下面,我们将逐一讨论 Fable 5 的各项新安全措施。模型的系统卡和我们最新发布的风险报告对更广泛的安全措施体系进行了讨论和评估。
Mythos 级别模型在前沿网络安全和研究生物学领域的能力意味着它们存在被恶意行为者利用的重大风险。也就是说,这些模型可能提供信息或建议,帮助恶意行为者造成他们从其他来源(例如互联网搜索引擎)无法获得的严重伤害。此外,AI 模型的很多高级应用都是双用途的:对网络安全专业人士和生物学研究人员有益的查询,如果被恶意行为者获得,可能会造成危害。
因此,我们需要强大的护栏来防止滥用,其覆盖范围必须很广。这些护栏本身必须能够抵抗持久的、复杂的绕过尝试(也称为"越狱"系统)。Mythos 级别能力的提升对许多对手来说都很有价值——例如那些可能从网络攻击中获利的人——因此我们预期他们会被激励去尝试绕过我们的安全措施。
Fable 5 配备了一套新的分类器:这些独立的 AI 系统可以检测潜在的滥用行为(包括越狱尝试),并阻止主模型(在本例中是 Fable 5)做出响应。我们已经在我们的模型上运行分类器有一段时间了,Fable 5 的分类器是先前工作的扩展,覆盖范围更广。
当 Fable 的分类器检测到与网络安全、生物学和化学或蒸馏相关的请求时,响应会自动由 Claude Opus 4.8 处理。用户会在发生这种情况时收到通知。Opus 4.8 本身是一个高能力的模型:来自 Opus 的回退响应远好于来自 Fable 的直接拒绝。我们的早期数据显示,超过 95% 的 Fable 会话根本不涉及任何回退——在这些会话中,Fable 5 的性能实际上与 Mythos 5 相同。
分类器覆盖的领域如下:
我们对分类器进行了广泛的红队测试,以测试其对越狱的健壮性。除了内部测试外,我们还进行了一个外部漏洞赏金计划,在超过 1,000 小时的测试中没有发现通用越狱。我们聘请的外部红队组织也未能在长形式智能体任务上找到任何通用越狱——尽管英国 AISI 在短暂的初始测试窗口内取得了进展。完全防止通用越狱可能是不可能的,但我们的目标是让任何剩余的越狱足够缓慢且成本高昂,以便我们能够在大规模使用之前检测和阻止它们。
下面的图表来自我们的一项内部评估,说明了 Fable 5 的护栏如何比我们之前的公共访问模型提供更强的抗越狱能力。
我们的一个外部合作伙伴发现,Fable 5 对有害网络查询的保护在所有测试的模型中最强大(包括 Opus 4.8 和 Opus 4.7)。Fable 5 对与计划网络攻击、漏洞开发或防御规避相关的零个有害单轮请求都遵守规则。无论请求是否使用了 30 种不同的公开越狱技术之一,这一点都成立。
例如,我们测试了 Mythos 5 在完成腺相关病毒 (AAV) 设计中的一个具有挑战性步骤的能力。AAV 是递送基因疗法的一个组成部分,但如果落入坏人手中,同样的能力可能会实现危险病毒的设计。在这项任务中,各种 AI 模型在预测遗传修饰如何影响病毒外壳组装的能力上进行了评估(在 Dyno Therapeutics 开发的一套治疗相关未公开候选物中)。我们没有明确训练我们的模型来执行这项任务——然而 Mythos 级别模型仅使用其生物学推理就超越了致力于蛋白质任务的复杂模型(称为"蛋白质语言模型")。这展示了完成基因疗法研究和开发中简单但重要任务的有前景的能力——但也突出了这种双用途能力带来的风险。
我们的优先级是尽快安全地发布 Fable,即使代价是过度宽泛的护栏。因此,暂时我们已安排 Fable 在大多数与生物学和化学相关的请求上回退到 Opus 4.8。与我们所有分类器一样,我们希望尽快缩小这些护栏的范围:如上面的证据所示,Fable 在科学中的应用潜力很大,我们不希望我们分类器的假阳性成为障碍。在接下来的几周里,一些生物医学研究人员和公司将能够加入我们针对 Mythos 5 生物能力的可信访问计划(下文讨论)。
最后,我们正在改变我们处理 Fable 5、Mythos 5 和未来具有相似或更高能力级别的模型的业务客户数据的方式。我们将要求对 Mythos 级别模型上的所有流量进行 30 天保留,无论在第一方还是第三方表面上。我们不会使用这些数据来训练新的 Claude 模型,也不会用于任何非安全相关的目的,我们已实施了新的隐私保护措施,包括记录所有人类对数据的访问,并确保在几乎所有情况下在 30 天后删除数据(详见此文章)。这些数据将帮助我们防御复杂和新颖的攻击(包括新的越狱和跨多个请求运作的攻击),以及帮助我们识别和减少假阳性。
从今天开始,所有当前有权访问 Claude Mythos Preview 的用户(例如我们在 Project Glasswing 中的网络安全合作伙伴)将能够升级到 Claude Mythos 5——与 Claude Fable 5 相同的模型,但网络护栏已解除。用户会发现 Mythos 5 在大多数情况下与 Mythos Preview 相当或略强,同时成本大幅降低。
与美国政府协商,我们计划稳步扩大对 Claude Mythos 5 的访问,继续定期添加新的合作伙伴,同时追求一个可信访问计划,允许网络安全组织以更系统的方式申请。
我们的计划还包括开放一个生物学可信访问计划,以帮助加速生物医学研究并用 Mythos 级别能力发现新疗法。该计划将提供对 Fable 5 的访问权限,但生物学和化学护栏已移除(网络护栏仍在原地)。它将从各种生物科学组织中注册一小部分研究人员,涵盖基础研究和转化研究;我们计划扩大对该计划的访问权限,同时改进我们的护栏。
Claude Fable 5 从今天开始随处可用。Claude Mythos 5 仅限于 Glasswing 合作伙伴(网络护栏已解除)和即将向选定生物研究人员提供(生物学和化学护栏已解除),直到我们更广泛的可信访问计划可用。
两个模型的定价为每百万输入令牌 10 美元,每百万输出令牌 50 美元。开发者可以通过 Claude API 使用 claude-fable-5。
我们预期 Fable 5 的需求会非常高,且难以预测。在 Claude API 和消费制企业计划上,Fable 5 从今天起完全可用。对于订阅计划,我们倾向于尽早提供访问权限,因此我们分阶段更加谨慎地推出:
从今天至 6 月 22 日,Fable 5 免费包含在 Pro、Max、Team 和按座位制企业计划中。
6 月 23 日,我们将从这些计划中移除 Fable 5。在此之后使用需要消费额度。如果容量允许,我们将延长包含期限。
在此之后,当容量允许时,我们的目标是将 Fable 5 恢复为订阅计划的标准部分。我们打算尽快完成此工作。
在整个时期,我们将提前沟通任何变更,以便用户了解最新状态。
编辑于 2026 年 6 月 9 日:更新了关于 AAV 的讨论,注明候选项由 Dyno Therapeutics 开发。
Mythos 级模型是 Claude 模型的一个层级,在能力上高于我们的 Opus 级。第一个 Claude Mythos Preview 于 4 月通过 Project Glasswing 发布。今天发布的是 Claude Fable 5 和 Claude Mythos 5。
Fable 来自拉丁文 fabula,意为"被讲述的东西",与希腊语 mythos 相近。护栏是区分这两个模型(Fable 和 Mythos)的特点,也是我们给它们取不同名字的原因。
指标:Firefox = 实现任意代码执行的试验比例(漏洞的完全成功级别)。OSS-Fuzz = 五级评分的严重性加权平均值(0.2 崩溃 → 1.0 控制流劫持),因此值是加权平均值而非成功率。CyberGym = 成功复现目标漏洞的比例(公开排行榜指标)。CyScenarioBench = 在其挑战中均匀平均的成功率。
通用越狱可定义为任何提示词、脚本或工具,允许用户与模型交互就像其护栏不存在一样。这与仅在非常有限的环境中有效或需要额外工作来适应每种新情况的轻微越狱相对。
Opus 5 是 Opus 级别的阶梯式改进,为长期运行的 AI 智能体提供支持,同时在编码和专业工作中带来改进。