8.0
热点
AI SCORE
编程提效2026-08-23 00:58
Anthropic 疑似对 Claude Code 实施 effort 级别 A/B 测试
Hacker News#Claude Code#AI编程#工具动态
Editor brief · 编辑速览
开发者发现 Claude Code 响应质量出现波动,疑似 Anthropic 在不同用户群体中测试降低推理成本(effort level)的策略,影响代码生成的详细程度和深度。
Anthropic 似乎正在对 Claude Code 的 effort 等级进行 A/B 测试
来源:Hacker News
🥔🥔🥔@argofowl 这是服务端的,不是 App 层面的。Anthropic 将 fable 5 在 Claude Code 2.1.236+ 上的会话纳入了一个实验,该实验缩小了 effort 量表的范围,旧版本和 opus 5 不受影响。这可能是一个 A/B 测试,所以不是所有人都会看到。如果你觉得 "high" 听起来像 "low",那说明你在实验组里。 妈的 Anthropic,你们有时候真是让人受不了 🥔🥔🥔@argofowl 这周 fable 感觉变笨了,不是你的问题 ❗❗❗ 自 2.1.237 起,模型把 "high" effort 解读为 10 分(满分 100),正好是以前 "low" 的数值,而且更新日志里一个字都没提。我花了整个下午才确信是 t3 代码和我自己的应用出了问题,然后才—— 显示更多 1:08 PM · Aug 22, 2026 37.8K 阅读 · 2413 转发 · 23529 评论



🥔🥔🥔@argofowl 你得看看这个破玩意儿 @theo 2.7K

Synoros@SynorosHQ 我该怎么办?跟一个擅自改产品的公司怎么合作? 12 11.5K
