介绍 Claude Code v2.1.221 的 Headroom 上下文压缩(节省 15-81% token)、基于描述的 Agent 路由以及 masked credentials 等安全修复。
Claude Code 正在从「智能提示框」演变为策略控制的执行层:如今最大的收益来自于路由、沙箱化,以及让 Agent 变得可审计,而非单纯地更聪明。
95.8% SWE-bench 耗时 119 秒
🔥 Headroom 压缩:长会话 Token 减少 15–81%
如果你的 Claude Code 会话规模庞大,在请求触及 Anthropic API 之前压缩冗余上下文,现在可以直接降低成本。用 headroom wrap claude 包装会话,然后检查 headroom_stats 来判断你的仓库/工作流是否真的可压缩。
📈 基于描述的 Agent 路由:解决从不触发的子代理问题
子代理失败的原因更多在于路由器无法匹配意图,而非模型质量。把 description 当作触发条件来对待,运行 /doctor 检查冲突,验证工具列表,确保专业角色能被选中而不是被忽略。
🔥 无状态 + 可审计的 Agent 胜过「记忆」炒作
本周最强的模式是保持 Agent 一次性、可记录、范围狭窄。这意味着把状态推到配置、钩子和显式工作流中,而不是指望模型从纠正中「学习」。
用 Opus、Sonnet、Haiku 路由任务以削减开销
升级到 v2.1.221 以获得凭证掩码和 zsh 修复
mode:"mask" 保护凭证,Focus 视图加速审查,还收录了 20 个安全修复用 claude --kill-all 终止卡住的后台会话
claude.ai/usage 变成了真实可靠的信号工具亮点
Headroom — 本地上下文压缩器,在 API 调用前裁剪冗余的会话状态 — 长运行时 Token 消耗减少 15–81%。
MCP Workbench — 基于浏览器的 MCP 调试器,让你可以粘贴命令、检查工具、在几分钟内验证协议合规性,而不是从日志中猜测。
SurrealDB hosted MCP — 一个 URL 的 MCP 端点,用于查询、部署和管理 SurrealDB 实例 — 无需本地服务器配置,还支持 Spectron 记忆功能。
本周最佳实践
带 Gateway + 审批的无头持久化 Agent
将 Claude Code 以 claude -p --input-format stream-json 运行在 Gateway 背后,用 PreToolUse 审批拦住危险步骤,并添加 OS 级沙箱化,这样 Agent 可以保持持久化而不会变得无边界。
模型路由集群:Opus 处理困难推理,Haiku 处理琐事
将循环拆分,让昂贵的推理模型只接触模糊任务,而更便宜的模型处理搜索、提取和常规编辑。这既降低开销又提升吞吐,因为瓶颈从模型成本转移到了编排质量上。
带背压的 Retry 感知 MCP 设计,在获取连接前拒绝
不要让急切的 Agent 猛击慢速数据库,而是在早期卸除工作,避免重试风暴放大故障。关键是保持恢复能力,而不是最大化即时重试率。
路线图
原生 MCP 服务器基准测试工具,支持延迟、重试和 Token 成本计数
更完善的子代理路由器诊断,能显示描述/工具匹配失败的原因
原生持久化 Agent 运行时,内置沙箱化、审批和会话恢复
Originally published on gentic.news