Anthropic 推出新版最小模型 Haiku 5.5,定价大幅下调,首次更新近一年,主打轻量级推理场景。
Anthropic 周三发布了 Claude Haiku 5.5,这是近一年来其最小、最实惠模型的首个新版本。
这也是 Anthropic 一个月内推出的第三款 5.5 系列模型,不过目前仍未见 Fable 5.5 的身影。该模型预计将经历更长的审查流程,因此稍晚发布并不意外。
与之前的迭代版本一样,Anthropic 将 Haiku 5.5 描述为"最快、效率最高的模型",但这一次它也便宜得多。Haiku 4.5 的价格为每百万输入/输出 token 1 美元/5 美元,Anthropic 此次将其降至 10 万 token 以内请求的 0.10 美元/0.50 美元。
Anthropic 将 Haiku 5.5 描述为"最快、效率最高的模型",但这一次它也便宜得多。
对于更大请求量的场景,新价格为 0.50 美元/2.50 美元(Haiku 4.5 不论请求 token 数量多少价格一致),但 Anthropic 指出,Haiku 4.5 约 90% 的请求落在了低价区间(这可能与开发者过往向 Haiku 发送的任务类型有关)。
这分别对应每 token 价格 90% 和 50% 的降幅。Anthropic 估算平均节省约 75%,这一数字综合考虑了请求类型的分布以及更新后 tokenizer 每个任务消耗略多 token 的因素。
新版本是首个支持 effort controls 的 Haiku 模型(默认值为 medium),让开发者能够控制模型在给定任务上消耗的 token 数量。
这类小模型的典型使用场景一直是处理高并发任务,如摘要、分类和路由。
当然,这也是 Jev 等决策模型目前大放异彩的领域——而且价格更低。
展望未来,Haiku 或 OpenAI GPT-6 Luna 这类小模型最具价值的场景可能不在上述领域,因此 Anthropic 同时指出该模型可以处理压缩和数据库查询任务,以及对速度敏感的 agent 工作负载,包括实时客户支持和浏览器操作,也就不足为奇了。
Anthropic 自身的评估显示,相较 Haiku 4.5 有明显提升。在 OSWorld 2.1 的离线子集(用于测试计算机使用能力)中,Haiku 5.5 得分为 72.4%,而前代产品为 15.7%,领先于 GPT-6 Luna 的 48.9%。
在 GDPval-AA v2.1 知识工作基准测试中,Haiku 5.5 得分为 1,620,而 Haiku 4.5 为 735,GPT-6 Luna 为 1,437。毋庸置疑,Sonnet 5.5 在两项基准测试中仍保持领先。
在 Terminal-Bench 4.0(测试命令行环境下复杂多步骤任务)中,Haiku 5.5 得分为 39.2%,Haiku 4.5 为 0%,GPT-6 Luna 为 16.4%,Sonnet 5.5 为 70.6%。
Anthropic 仅将 Haiku 5.5 与自家模型和 OpenAI 的 GPT-6 Luna 进行直接对比。但在小型模型领域,许多开发者同样在关注来自 Z.ai、阿里巴巴等竞争对手的产品。
Artificial Analysis 目前给 Z.ai 的 GLM-5.3-Flash 在 GDPval-AA v2.1 上打出 1,647 分,在 AA-Briefcase v1.1 上打出 1,454 分。相比之下,Anthropic 报告的 Haiku 5.5 分别为 1,620 和 1,578。
还有更便宜的选择。在阿里巴巴国际服务上,Qwen3.7 Flash 对于不超过 32,000 token 的输入价格为每百万输入 token 0.03 美元、每百万输出 token 0.13 美元。对于 32,000 到 256,000 token 的输入,费率分别上升至 0.10 美元和 0.40 美元。
Haiku 5.5 可通过 Claude Platform、亚马逊云服务(AWS)、Google Cloud 和微软 Azure 获取。使用 Anthropic 平台的开发者可通过 claude-haiku-5-5 访问。该公司还将在 Python 和 TypeScript SDK 中增加 computer use 和 browser use 的 beta 支持。
伴随着新模型发布,Anthropic 将 Sonnet 5.5 的缓存读取价格减半,从每百万 token 0.20 美元降至 0.10 美元。公司表示这将使大多数 agent 任务成本降低约 20%。此次降价周三起在各大平台陆续推送,不过部分现有 Azure 和 Google Cloud 客户需要等待数天。
Anthropic 将 Sonnet 5.5 的缓存读取价格减半
Anthropic 还将在本周为 Max 和 Team 订阅增加月度 API 额度。Max 5x 订阅用户每月获得 100 美元,Max 20x 订阅用户每月获得 200 美元。Team 订阅用户将共享最多 500 美元额度。额度可用于 Claude Platform 上的任意模型。
Haiku 5.5 还具备比 Haiku 4.5 更严格的网络安全防护措施,不过 Anthropic 表示这些防护允许执行比 Sonnet 5.5 更广泛范围的防御性工作。渗透测试仍被禁止。需要更广泛访问权限的机构可申请加入 Anthropic 的验证计划。