服务器端AI Agent运行框架,Session持久化、支持SRE场景故障根因定位、加密凭证存储,延迟大幅降低。
Anthropic 工程师演示了 Claude Managed Agents,这是一套服务端 AI Agent 架构,P95 延迟降低超过 90%,还演示了一个 SRE Agent 将 P99 延迟峰值追踪到某一次提交的过程。
Anthropic 的一位工程师演示了 Claude Managed Agents——一套用于生产环境 Agent 的服务端开发框架。演示中包含一个 SRE Agent,它将 P99 延迟峰值追溯到了某一次具体的代码提交。
Claude Managed Agents 在 Anthropic 工程师的演示中首次亮相,是一套全新的服务端 AI Agent 运行框架,无需自行管理托管或扩缩容。根据 @_vmlops 的介绍,其架构将 Agent(大脑)、环境(双手)和会话(黏合剂)分离,Agent 循环在服务端执行,而工具调用则解耦。会话在刷新后仍然保持,这是长时间运行的生产工作流的关键需求。
演示重点展示了几项生产就绪特性:P95 首 token 时间降低超过 90%、自带计算资源选项、加密凭证保险库、子 Agent、记忆功能、结果追踪以及 webhook 触发器。该公司未披露该托管服务的具体延迟数据或定价信息。
其核心是一个构建在该框架上的 SRE Agent,它能实时调查 P99 延迟峰值。它分析了指标、部署记录和代码 diff,然后将事故追踪到导致该问题的具体提交。这超越了典型的 Agent 演示——后者通常聚焦于代码生成或检索,而非运维故障排查。
向服务端执行的转变解决了一个常见痛点:Agent 失去状态或需要重型客户端基础设施。通过解耦工具执行并保持会话持久化,Claude Managed Agents 将自身定位为一个用于持续、自动运行的平台。自带计算资源选项值得关注,表明 Anthropic 正在瞄准需要将数据保留在自有基础设施中的企业。
Anthropic 尚未宣布 Claude Managed Agents 的正式发布或定价。不过,演示传递了一个明确信号:该公司正在力图占据 Agent 运行时层的主导地位,与 OpenAI 的类似产品以及 LangGraph 等开源框架展开竞争。
关注 Anthropic 对 Claude Managed Agents 的正式发布公告,包括定价和 GA 时间表。需要跟踪的关键指标:企业在自带计算资源选项上的采用情况,以及 90% P95 延迟改善能否在第三方基准测试中得到验证。同时关注 OpenAI Agent 平台的竞争反应。
Originally published on gentic.news