前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9492
  • GPT-6发布:内置可交互UI组件,Haiku 5.5降价75%
  • Claude Haiku 5.5 定价解析:超 10 万 token 后性价比骤降
  • Agent 置信度层:何时判定模型「不知道」
  • Claude Haiku 5.5 正式发布:百万上下文、百万 token 仅 $0.10
  • 让 AI Agent 变得无聊:确定性层设计
  • GitHub Copilot 已上线 Claude Haiku 5.5
  • DeepGEMM 开源:英伟达 GPU 高性能 GEMM 内核库
  • 如何防止AI Agent向诈骗者付款:地址风险检查实战
  • x402支付第四大陷阱:无支出策略导致的钱包耗尽
  • GPT-6 发布:ChatGPT 新增交互式 UI,可生成图表按钮
  • Claude Haiku 5.5 登陆 AWS,性价比提升 75%
  • Claude Haiku 5.5 基准跃升 72.4%,价格下调九成
  • n8n AI Agent 五大生产环境故障及修复方案
  • 验证Agent不要看输出,要看状态diff
  • Claude Code按决策类型而非难度分配模型
  • K3 vs DeepSeek V4:开源模型如何选型
  • OpenAI 发布 722 篇数学论文
  • Cloud Run 免费自定义子域名:告别复杂 Demo URL
  • OpenAI 失控 Agent 在维基媒体项目活动曝光
  • GitHub Copilot 修复用量统计中 Agent 活动丢失问题
  • OpenAI 发布数百个数学难题的解答成果
  • 29款LLM谄媚度基准测试:前沿模型稳住了,小模型全面溃败
  • llm-openai-decisions 插件发布:支持 GPT-6 Astra 决策 API
  • Anthropic开放Claude最强版本用于安全测试:已发现10万漏洞
  • 谷歌 EmbeddingGemma 2:7.4 亿参数多模态嵌入模型,手机端 191MB 即可运行
  • 无 API 桌面应用远程控制方案:用 CDP 桥接手机与 Claude Code
  • AI功能按调用计费:多数设计在浪费预算
  • Simon Willison 点评 EmbeddingGemma 2:开源权重是嵌入模型唯一理智选择
  • Mistral Large 4预览发布:参数破万亿
  • Google发布EmbeddingGemma 2:开源多模态嵌入模型
  • Google 开源 EmbeddingGemma 2:740M 参数端侧向量模型,191MB 内存跑离线 RAG
  • 间接提示注入攻击链解析与防御架构
  • 已加载 32 / 9492
8.0
热点
AI SCORE
模型发布2026-10-08 04:56

Claude Haiku 5.5 定价解析:超 10 万 token 后性价比骤降

Simon Willison#Claude#Haiku#定价
Editor brief · 编辑速览

Haiku 5.5 与 GPT-6 Luna 定价相同($0.10/$0.50/百万 token),但超过 10 万 token 后价格涨 5 倍,新 tokenizer 实际 token 数多 25%,长文本场景 Luna 更划算。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

正如之前承诺的,这里是 Anthropic 新的快速、低成本模型:Introducing Claude Haiku 5.5。

上一代 Haiku 4.5 已经明显落后于时代。它近一年前发布,定价为每百万输入 token 1 美元、每百万输出 token 5 美元——即便在当时也相对昂贵,更是 OpenAI 上个月发布的 GPT-6 Luna 价格的整整 10 倍。

新 Haiku 与 GPT-6 Luna 的价格完全一致——$0.10/$0.50——在 10 万 token 以内。超过 10 万 token 后价格涨 5 倍至 $0.50/$2.50。Luna 本人在 27.2 万 token 处才涨价,但也只到 $0.20/$0.75。

Haiku 5.5 还采用了一种新的、不那么慷慨的分词器。我的 Claude Token Counter 工具显示,同一个长 prompt 用 Haiku 5.5 比 Haiku 4.5 多消耗约 1.25 倍的 token,所以这里面隐藏了一次涨价。

如果工作负载在 10 万 token 以内,Haiku 和 Luna 价格相同,但 Haiku 报告的基准分数更高。超过 10 万 token 后,Luna 看起来是更划算的选择。

llm-anthropic 的最新版本终于解决了问题,我不需要为每个新模型都发布新版本。我是这样测试新模型的:

llm install -U llm-anthropic
llm anthropic refresh
llm -m claude-haiku-5.5 "Generate an SVG of a pelican riding a bicycle" -o thinking_effort low

以下是 low、medium、high、xhigh 和 max 级别的 pelican。新版 Haiku 不允许禁用推理,且默认级别为 medium。low 以上的级别我都得到了不错的自行车车架。low effort 的 pelican 花费 0.0936 美分,耗时 7 秒。

这个 max effort pelican(推理追踪以"This is the classic pelican-on-bicycle SVG test..."开头)耗时 5 分 9 秒生成,但仍然只花费了我 3.3826 美分:

Flat vector illustration: a white pelican wearing a red cap rides a dark grey bicycle from left to right across a green grassy strip, its long orange legs reaching down to the orange pedals, a grey wing stretched forward to grip the curved handlebars, and its large yellow-orange beak with a bulging orange throat pouch pointing ahead; behind it, white speed lines show motion, and above, a yellow sun with a pale halo and two white clouds sit in a gradient blue sky.

(既然推理追踪展现了对该基准的认知,这里是 Generate an SVG of an armadillo in fishnet tights jaywalking on Mars(xhigh),以及同一个 prompt 在其他一些近期模型上的表现。相关背景。)

作为对比,这里是一年前从 Haiku 4.5 得到的 pelican(花费 0.7583 美分——Haiku 4.5 不支持推理级别)。它画 pelican 的能力糟糕透了:

除了 Haiku 5.5,Anthropic 今天还宣布将 Sonnet 5.5 的缓存读取价格减半。他们还为订阅计划增加了 API 额度:

其次,本周我们将向所有 Max 和 Team 订阅者推出一项新的月度 API 额度,可用于 Claude Platform。Max 5x 用户每月可获得 100 美元额度,Max 20x 用户可获得 200 美元,Team 订阅者可获得最多 500 美元,在用户之间共享。

领取非常便捷:导航到 Settings -> Billing,选择每月应该获得额度的 API 组织:

Screenshot of a Settings dialog with a close X button at top right and a row of tabs reading "General", "Account", "Privacy", "Billing" (selected), "Usage", "Capabilities", "Memory" and "Design sys" (cut off at the edge). Beside a line-drawn icon of a branching plant with circular buds, the panel reads "Max plan", "20x more usage than Pro" and "Your subscription will auto renew on Nov 2, 2026." with an "Adjust plan" button on the right. Below is a section headed "API credits" with a blue "New" badge, reading "Your Max 20x plan includes $200 USD in API credits each month." followed by grey text "Link an API organization to start receiving credits." with a "Link organization" button on the right.

API 额度与订阅本身的价格完全一致。这真的很慷慨——让订阅者更容易使用 API。Anthropic 还允许你禁用 API 自动充值,代价是"余额耗尽时 API 请求将停止"——如果你打算用完这些 API 额度而不想收到惊人的账单,这正是你想要的。

请注意,月度额度不会结转——用掉或失去它。

OpenAI 仍然允许你将 Codex 订阅用于个人 API 使用,这对重度 API 用户来说是更划算的交易。这项新的额度方案至少在一定程度上弥补了这一差距。

We're going to need default hard budget caps on pretty much everything - 3rd October 2026

OpenAI DevDay 2026 live blog - 29th September 2026

This is Claude Haiku 5.5 by Simon Willison, posted on 7th October 2026.

Previous: We're going to need default hard budget caps on pretty much everything

Sponsor me for $10/month and get a curated email digest of the month's most important LLM developments.

Pay me to send you less!

Original source

本文由 AI 翻译整理自 Simon Willison,原文版权归原作者所有。

阅读英文原文
上一篇
GPT-6发布:内置可交互UI组件,Haiku 5.5降价75%
下一篇
Agent 置信度层:何时判定模型「不知道」