前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8655
  • 阶跃Step 5 Preview实测:27B参数开源模型冲至Top2
  • 用Responses API构建有边界的GPT-6 Astra Agent
  • 用破坏不变量法审查 AI 生成代码
  • AI 编程测试冻结:保存异常指纹而非测试名
  • 程序员亲历:全公司用 Claude Code 批量生产代码,没人读代码,12 小时工作制
  • 自托管Llama部署成本全解析:GPU之外容易被忽视的隐性开销
  • Builder.io开源Agent-Native框架:让人与AI共享同一操作层
  • 让AI编程代理在中断后从断点恢复:session化执行轨迹方案
  • CI如何验证AI代理真的跑了测试而不是伪造结果
  • llm-keys-ui:让Coding Agent安全获取API密钥的插件
  • AI产品定价数学:固定费率如何悄悄亏损
  • ZCode事件:AI编程工具静默上传全部Git历史
  • Anthropic自评:R&D自动化率26%,但完全自主为0
  • 阿里Qwen-Image-2.1:70亿参数开源图像生成拳打闭源模型
  • OWASP CRS 规则引擎:给 LLM 和 MCP 加上 WAF
  • 智谱 MaaS 上线数据不留存机制,可申请开通
  • 如何界定可完成的AI工程范围
  • Cursor中直接查询技术文档的MCP方案
  • AI Agent的过度自信陷阱
  • Cursor与.NET周报:七个实战规则
  • AI Agent失效?模型可能不是根源
  • Qwen-Image-2.1开源:7B参数兼顾生图与编辑
  • 阿里开源 Qwen-Image-2.1:7B 参数兼顾透明图生成与多图编辑
  • 免费模型Trace不能支持的五个评估主张
  • AI重构前的副作用冻结术:先录 Ledger 再动格式
  • Agent能改Oracle则Green Build不足为信:独立检查三原则
  • AI编程导致代码质量下降?根子在质量管理
  • AI连接数据库必须先脱敏:PII保护实战指南
  • Anthropic与埃森哲20亿美元共建AI安全评估体系
  • Copilot CLI恢复检查点导致1GB未跟踪文件被删
  • AI代码审查升级:结果直发PR评论,淘汰复制粘贴
  • Higgsfield:开源万亿参数模型分布式训练框架
  • LlamaIndex多Agent工作流:事件驱动共享状态编排
  • 用AI从45条Ruff PR评论中挖掘团队隐式代码规范
  • LLM Agent工具授权最佳实践:五步检查清单
  • Agent补丁评分应只看其未写的断言
  • 2026年9月 Ollama 编程模型实测推荐
  • 国产大模型价格实测:GPT-5 三到八倍溢价
  • Codex-X:OpenAI Codex桌面端可视化综合管理工具
  • Docling:支持复杂PDF结构的文档解析库,集成主流AI框架
  • NVIDIA PAIR:开源本地多Agent推理路由,支持Ollama/LM Studio
  • 阿里Qwen发布Qwen3.8-LiveTranslate:60语言实时翻译,延迟仅2.3秒
  • Supermemory:AI记忆与上下文引擎开源实现
  • OpenSpec:AI编程时代的规格驱动开发框架
  • MCP Agent工具集成测试实战指南
  • Claude Code 在 Zed 中的 ACP 协议传输机制实测
  • Mubayyin:基于结构化知识库做 AI 发布决策的智能体
  • 阶跃发布 Step 5 Preview:开源模型前三,单任务成本仅 Claude Opus 5 的 1/8
  • OpenClaw 2026.9.5:原子更新、插件热重载、对话分享与GPT Live扩展
  • Jev:返回类型化校准决策的System One模型
  • Gemini越狱事件:测试中入侵三家公司,Google隐瞒四月
  • 已加载 51 / 8655
8.0
热点
AI SCORE
技术实践2026-09-20 22:04

AI Agent失效?模型可能不是根源

The New Stack#AI Agent#生产实践#故障排查
Editor brief · 编辑速览

AI Agent投入生产后失败路径难以预测,文章指出模型本身往往不是问题所在,指向工作流设计和工程实践。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

随着 AI 代理进入生产环境,从请求到结果之间的路径变得越来越不可预测。代理可以自主选择工具并在工作过程中改变方向,这让失败诊断变得更加困难——当没有明显的错误可以追溯时,问题很难定位。

在近期一次接受 The New Stack 采访时,Nvidia 产品副总裁 Adel el Hallak 描述了开发者随着代理承担更复杂的工作将需要怎样的额外可见性。

Nvidia 同时也在推进行业内的共享努力,分享各公司在这些系统失败时学到的经验。安全代理发现交换协议(Secure Agent Findings Exchange,简称 SAFE)获得了约 140 家公司的支持,旨在创建报告代理失败的共享基础设施,借用了传统软件中的漏洞披露机制。

"当我们发现这些漏洞时,不仅仅是为了某一家公司," el Hallak 告诉 The New Stack。"而是为了让所有人都能打上补丁。"

但代理失败并不一定能追溯到单一组件,这就给开发者提出了一个更基本的问题:当一个代理失败了,你究竟要调试什么?

"当我们发现这些漏洞时,不仅仅是为了某一家公司。而是为了让所有人都能打上补丁。"

传统可观测性为何不够用

在传统软件中,当出现问题时开发者通常有一个起点,无论是异常、失败的请求还是宕机的服务。而代理可以在朝着错误方向前进的同时继续运行,将早期的错误一路携带到后续任务中,却不会产生任何看起来像传统软件失败的东西——或者如 el Hallak 所说,只是在不该"发挥创意"的时候自作主张地"发挥创意"了。

即使表现最好的编码代理,在从真实代码库中提取的任务上失败率也超过 60%。知道代理失败了是一回事,知道为什么失败则是另一回事。

"仅仅查看日志、输入和输出是不够的," el Hallak 告诉 The New Stack。"重要的是弄清楚它是如何得到答案的。推理轨迹是什么?它使用了哪些工具?在哪里卡住了?在哪里决定尝试新方法的?"

这可能需要重放代理的执行过程,以查看它在哪里偏离了轨道。看起来像是模型失败的问题可能起始于堆栈的其他地方。这正是让开发者头疼的部分。代理的 bug 不一定是模型的 bug。

"仅仅查看日志、输入和输出是不够的。重要的是弄清楚它是如何得到答案的。推理轨迹是什么?它使用了哪些工具?在哪里卡住了?在哪里决定尝试新方法的?"

运行时作为收集点

Nvidia 认为运行时是捕获大部分这类信息的合理位置。其 OpenShell 代理运行时位于 NemoClaw 平台之下,负责管理沙箱、策略执行,同时提供对代理执行过程的可见性。

El Hallak 称 OpenShell 是 Nvidia 参考架构中唯一一个不可妥协的组件。

"你可以更换任何你需要的 harness。我甚至开放地接受使用任何你需要的模型," el Hallak 告诉 The New Stack。"但治理、我们始终希望利用的安全开放的运行时是 OpenShell。"

Nvidia 将代理堆栈分为三层:模型提供智能,harness 编排其工作,运行时governs执行。当代理失败时,模型本身可能并不是出问题的地方。

例如,Nvidia 的 NOAH 研究表明,在保持底层模型不变的情况下更换 harness 可以提升代理性能,这也意味着一个匹配不好的 harness 可以拖累一个本来能力足够的模型。

"每个模型都不同。有些可能比其他的更话多," el Hallak 告诉 The New Stack。"确保这两者要么共同开发,要么有针对模型特定的配置文件,这是一个新的突破点。"

安全作为系统工程

Nvidia CEO 黄仁勋将 AI 安全描述为一个工程问题,el Hallak 将这种方法比作传统软件测试。

"如果你的软件有 bug,你不会发布它," el Hallak 告诉 The New Stack。"你会一直工作直到它被修复并通过所有测试。"

代理让这种模式变得更加复杂,因为复现一个失败可能需要重建整个系统发生了什么。这需要检测手段,而这是有代价的。OpenAI 发现,对其最具能力的持久代理来说,监控大约增加 20% 的推理计算成本。

Nvidia 的方法结合了受治理的 harness、沙箱化运行时和机密计算,旨在保护模型和用户数据。

"有办法让你一直到底层硅片都做出保证," el Hallak 告诉 The New Stack。

SAFE 通过为企业创建共享基础设施来扩展这种工程方法,让他们能够分享代理失败时学到的经验。

"如果你的软件有 bug,你不会发布它。你会一直工作直到它被修复并通过所有测试。"

代理调试其他代理

CrowdStrike 正在基于多年的安全数据对 Nvidia 的 Nemotron 模型进行微调,以创建配对代理——一个发现漏洞,另一个修补它们。

如果其中任一代理出了问题,最终输出可能无法揭示原因。例如,一个糟糕的补丁可能追溯到模型、代理的执行路径或它一路上使用的工具。

"对于给定任务,我不需要通用能力。我需要的是专业化," el Hallak 告诉 The New Stack。

随着各公司围绕越来越专业化的工作流构建代理,这些失败可能不会出现在通用模型基准测试或安全测试中,这给开发者带来了更大压力,要求他们理解执行过程中发生了什么。

迈向共享失败报告

对于平台团队来说,发现失败是一个问题。重建足够的代理执行过程以理解其成因是另一个问题。

SAFE 旨在让这些发现在发现它们的公司之外也能发挥作用。传统软件已经建立了分享漏洞和修复方案的系统,但代理失败方面还没有可比较的东西。目标是避免每个团队都必须自己发现同样的失败。

Original source

本文由 AI 翻译整理自 The New Stack,原文版权归原作者所有。

阅读英文原文
上一篇
Cursor与.NET周报:七个实战规则
下一篇
Qwen-Image-2.1开源:7B参数兼顾生图与编辑