Claude Sonnet 5发布
Anthropic发布Claude Sonnet 5,在社区引发极高热度,预示显著的能力提升,对使用Claude的开发者影响重大。
Anthropic发布Claude Sonnet 5,在社区引发极高热度,预示显著的能力提升,对使用Claude的开发者影响重大。
Claude Sonnet 5 旨在成为迄今 Agent 能力最强的 Sonnet 模型。它可以制定计划,使用浏览器和终端等工具,并以自主方式运行——而就在几个月前,要达到这种水平还需要更大、更昂贵的模型。
对许多开发者来说,Agentic AI 时代始于 Sonnet 级别的模型:Claude Sonnet 3.5、3.6 和 3.7 是最早在编程和工具使用方面展现出卓越能力的模型。不过最近,Agent 能力最显著的提升主要出现在我们的 Opus 级别模型上。
Sonnet 5 缩小了这一差距:它的性能已接近 Opus 4.8,但价格更低。与上一代 Sonnet 4.6 相比,它在推理、工具使用、编程和知识工作等 Agent 性能的重要方面都有显著提升:
我们的安全评估发现,Sonnet 5 出现不良行为的总体比例低于 Sonnet 4.6,通常也更适合安全地用于 Agent 场景。评估还显示,它执行网络安全任务的能力远低于我们当前的 Opus 模型。
从今天起,Claude Sonnet 5 将面向所有套餐提供:它是 Free 和 Pro 套餐的默认模型,Max、Team 和 Enterprise 用户也可以使用。它同样已在 Claude Code 和 Claude Platform 上线。Claude Platform 的首发优惠价格为每百万输入 token 2 美元、每百万输出 token 10 美元,有效期至 2026 年 8 月 31 日;此后价格将调整为每百万输入 token 3 美元、每百万输出 token 15 美元。开发者可以通过 Claude API 使用 claude-sonnet-5。
下方图表比较了 Sonnet 5、Sonnet 4.6 和 Opus 4.8 在不同 effort level 下,分别在 Agent 搜索评估 BrowseComp 和计算机操作评估 OSWorld-Verified 中的表现。Sonnet 5(橙色线)全面优于 Sonnet 4.6(灰色线),而且相比 Opus 4.8(黄色线),覆盖了范围宽得多的成本—性能选项。在 medium effort 下,它的成本效率得到了显著提升;在 higher effort 下,它在部分任务上的表现可以媲美 Opus 4.8。用户可以在 Sonnet 5 和 Opus 4.8 之间调整 effort level,找到合适的成本与性能平衡点。
早期体验合作伙伴给出的反馈非常一致:Sonnet 5 的 Agent 能力远强于前代产品。测试者提到,它能够完成以往 Sonnet 模型会半途而止的复杂任务;即使没有被明确要求,也会自行检查输出;而且能以颇具吸引力的价格完成所有这些 Agent 工作:
我们的部署前安全评估发现,总体而言,Sonnet 5 相比 Sonnet 4.6 有所改进。在 Agent 安全方面,该模型更善于拒绝恶意请求,也更能抵御 prompt injection 攻击中的劫持尝试。与 Sonnet 4.6 相比,该模型出现幻觉和谄媚行为的比例更低。在我们的自动化行为审计中——该审计会测试协助滥用、欺骗等广泛的不对齐行为——Sonnet 5 的总体得分更低(也就是更安全)。不过,在这项评估中,与能力更强的 Opus 4.8 和 Claude Mythos Preview 相比,它表现出的不对齐行为比例略高。
我们没有刻意针对网络安全任务训练 Sonnet 5。它可以执行一些常规且无害的网络安全任务,但在测试潜在危险网络安全技能的评估中,例如开发软件漏洞利用程序,它的表现明显不如 Opus 4.8 和 Mythos 5 等模型。下方图表展示了一项评估的得分,该评估测试模型针对 Firefox 浏览器漏洞开发 exploit 的能力。Sonnet 5 从未成功开发出完整可用的 exploit,但与 Sonnet 4.6 相比,它取得部分成功的比例确实略高。这一变化很可能源于通用智能的提升,而不是针对性训练。
由于 Sonnet 5 在这些任务上的能力略强于上一代模型,我们在发布时默认启用了网络安全防护措施。这些防护措施能够实时检测并阻止危险的网络安全用途,与 Claude Opus 4.7 和 4.8 所使用的措施相同(由于我们判断 Sonnet 5 带来的总体网络安全风险较低,因此这些防护措施没有随 Fable 5 上线的措施那么严格;后者会阻止范围广得多的网络安全任务)。¹
我们对 Sonnet 5 进行的多项安全与能力评估,其完整结果收录在 Claude Sonnet 5 System Card 中。
Claude Sonnet 5 从今天起全面开放,首发优惠价格为每百万输入 token 2 美元、每百万输出 token 10 美元,有效期至 2026 年 8 月 31 日。此后将恢复标准定价,即每百万输入 token 3 美元、每百万输出 token 15 美元。² 我们已经提高了 Chat、Cowork、Claude Code 和 Claude Platform³ 的 rate limit,以适应更高 effort level 带来的更高 token 用量;用户可以根据具体项目选择适合自己的级别。
2026 年 6 月 30 日编辑:在本文最初的版本中,我们提供了一张 BrowseComp 评估的成本—性能图表,但该图表采用的是一种较为简单的方法所产生的数据,没有体现我们在 Agent 搜索评估中使用的标准方法。这导致 Sonnet 5 在该评估中的性能被低估。
我们现已更新图表,使其与 Sonnet 5 System Card 中采用并讨论的方法保持一致;该方法使用 1000 万 token 预算,并启用 compaction 和 programmatic tool calling。我们还更新了相关文字。
¹ Sonnet 5 已纳入我们的 Cyber Verification Program。该计划目前已在原生 Claude Platform、AWS 上的 Claude Platform,以及 Microsoft Foundry 中的 Claude(托管于 Azure 和 Anthropic)开放,并即将在 Google Vertex 上的 Claude 中推出。已经加入 Cyber Verification Program 的组织会自动获得 Sonnet 5 的同等访问权限,无需重新申请。总体而言,对于需要减少 guardrail 的网络安全工作,我们推荐使用 Claude Opus 4.8。
² Sonnet 5 是 Sonnet 4.6 的升级版本,但它使用了更新后的 tokenizer,改变了模型处理文本的方式,从而提升性能;这与我们在 Claude Opus 4.7 中引入的 tokenizer 变更类似。其代价是,相同的输入可能会映射为更多 token:具体取决于内容类型,约为原来的 1.0~1.35 倍。首发优惠价格经过专门设定,以确保迁移至 Sonnet 5 时的成本大致保持不变。
³ 2026 年 4 月 26 日,我们提高了原生 Claude Platform 上每个使用级别的 Sonnet 和 Haiku rate limit,并将其简化为三个级别:Start、Build 和 Scale。你可以在 Claude Console 中查看自己所在的级别及当前限制,也可以阅读文档了解更多信息。
Humanity’s Last Exam:我们更新了 Humanity’s Last Exam 的 grader model,并将 Sonnet 4.6 的得分更新为 34.6%(不使用工具)和 46.8%(使用工具)。这就是该得分与 Sonnet 4.6 发布博客中所报告的结果不同的原因。
OSWorld-Verified:我们调整了 OSWorld-Verified 评估的运行方式,以便更准确地反映模型在真实世界中的表现,并将 Sonnet 4.6 的得分更新为 78.5%。这就是该得分与 Sonnet 4.6 发布博客中所报告的结果不同的原因。
Opus 5 为 Opus 系列带来了跨越式提升,可为长时间运行的 Agent 提供支持,同时进一步改善编程和专业工作表现。