前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8485
  • 坏Prompt正在浪费你的免费模型调用:先做PromptLint
  • AI 生成配置变更的 Receipt-First 安全预检法
  • 如何检测恶意MCP服务器:对比烟雾测试实战
  • PixelRAG:让 Claude Code 直接理解和检索带表格/图表的文档
  • 微小视觉扰动可击溃多模态 Agent 的未来预测
  • AI 编程沙盒的双重计费陷阱
  • Qwen3.8-27B 本地运行指南:17GB 指的是总内存
  • 生产 RAG 中嵌入模型漂移的隐藏风险
  • 数据库开发者为什么需要了解 MCP
  • RAG 评估实战:如何摆脱「感觉还行」的主观判断
  • 79% 的企业员工绕过 AI 治理政策
  • AI 找 bug ≠ 证明 bug 存在
  • 混合搜索实战:关键词+语义+Rerank 提升文档问答精度
  • Agent 记忆问题的本质是检索问题
  • AI Agent 数据删除管道设计实战
  • 票务分类 API 设计:语音转写与多模型摘要的最优组合
  • AI 在独立项目中自主修复跨域 iframe DOM 查询缺陷
  • 基于实时美股深度数据构建订单簿失衡信号
  • Claude 系统提示词两年增长 9 倍:生产 AI 产品团队该学什么
  • 开源工具 whodunit:用 Git/DevLake 数据量化团队 AI 采用效果
  • AI Agent 开发常见反模式:业务逻辑不应委托给 LLM
  • 构建混合搜索实战:关键词+向量+重排序完整管道
  • 多 Agent 系统调试:为什么「跑通了」不等于「对了」
  • Agentic AI与RAG根本不是一回事
  • OpenAI Codex向ChatGPT用户开放百万Token上下文
  • 代码库本身就是提示词:给AI参照已有实现比空想更有效
  • DeepTutor:港大数据科学实验室3层记忆Agent-native学习工作区
  • 用CI自动化比对Prompt变更,避免模型输出悄然退化
  • DeepSeek Harness开源自进化Agent框架,4天获12.6万星
  • 用事件总线架构拆解长链路Agent,避免单点故障蔓延
  • LLM性别偏见藏在prompt写法而非提问者身份
  • 20分钟重塑AI工作流:五步框架释放LLM潜力
  • 184个AI API成本实测:企业与初创公司差异分析
  • ChatGPT macOS隐私检查清单:Computer History安全配置
  • 美团AI变革复盘:全员养虾翻车与CatPaw落地方法论
  • Unsloth桌面版发布:单GPU运行7440亿参数模型,支持本地编码Agent
  • 同一终端双信任级别:Claude Code对接廉价代理节省API成本
  • Cursor推出自有代码托管服务
  • 测试时训练:模型边推理边学习新权重
  • Cursor Origin 仓库现已支持 Vercel 自动化部署
  • GPT-5.6 Sol在AI Gateway五折优惠一个月
  • Replit企业版大规模管控:Admin API与50+事件审计日志上线
  • macOS 屏幕共享漏洞正遭活跃利用,可远程获取 Root 权限
  • Linux 7.2 稳定版发布:I/O 性能优化、AMD/Intel 显卡驱动改进
  • 2026年8月AI基础设施与推理平台定价对比:18款工具每日更新
  • EU AI Act水印规定生效:AI生成内容标记可被伪造吗
  • Java 21 + Spring Boot + React 19 构建AI提示词管理平台
  • 30个AI API价格实测:价差高达350倍
  • 向量数据库深度解析与DataLoader实现
  • Pizza-Builder 法则:结构化提示词设计避免 AI 反复猜错
  • Anthropic API Prompt Cache深度分析:22%命中率才回本
  • 已加载 51 / 8485
8.0
热点
AI SCORE
技术实践2026-08-17 10:56

AI Agent 开发常见反模式:业务逻辑不应委托给 LLM

dev.to · AI#AI Agent#LLM#工程实践
Editor brief · 编辑速览

文章指出将所有业务规则写入 prompt 是危险反模式,建议将验证逻辑保留在应用层,只让 LLM 负责推理和规划;同时强调要对工具调用做白名单限制以防止 Agent 失控。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

深入 AI Agent 开发,我反复在个人原型项目和早期生产项目中看到同样的错误。这些反模式在本地测试时看起来无害,但一旦真实用户流量到来就会导致全面崩溃。

本文将逐一讨论我踩过的实际坑,不涉及高层理论。

反模式一:将 LLM 作为唯一事实来源

一个常见陷阱:把所有决策完全委托给大语言模型,所有逻辑、验证、条件判断都放在 Prompt 文本里。

Prompt 会漂移。模型输出在每次 API 调用间会有差异。Temperature 设置会改变行为。

更好的做法:将业务规则、验证逻辑和硬约束保留在应用代码中。用 LLM 做推理、规划和自然语言理解,而不是强制执行刚性规则。不要把关键逻辑变成 Prompt 注释。

反模式二:过度依赖无限工具访问

许多 Agent 演示让模型不受限制地访问所有可用工具。听起来很强大,但造成了巨大风险。

Agent 可能出于好奇调用无关工具,无限重试失败的端点,或者在用户不知情的情况下触发昂贵操作。

针对每个任务采用工具白名单 限制每个工具在单个工作流中的调用次数 将只读工具与破坏性写操作工具分离 对修改数据的操作要求明确确认

反模式三:忽略部分失败状态

当所有 API 调用都成功时一切都很美好。一旦某个工具返回错误,许多 Agent 实现就会崩溃。

它们不跟踪哪些步骤成功了、哪些失败了,也无法恢复工作。整个任务从头重启,浪费 Token 和用户时间。

你需要显式的状态跟踪:保存哪些子任务已完成、哪些待处理、哪些已失败。当错误发生时,在本地恢复而不是重置整个 Agent 会话。

反模式四:无限任务迭代

很容易忘记给 Agent 循环设置上限。面对模糊的问题,Agent 可能陷入死循环:计划、执行、观察、再计划、重复。

计算成本迅速飙升,用户无限期等待。

始终设置硬限制:

单个用户请求的最大子任务数 单个会话的最大 Token 预算 超时阈值。超过时停止执行并向用户返回状态报告

反模式五:观察与决策不做区分

Agent 读取工具输出,但许多开发者将原始、未过滤的工具响应直接塞回 Prompt。

嘈杂的日志、大型 JSON 转储、堆栈跟踪会迅速撑满上下文窗口。重要信号被无关文本淹没。

添加一个轻量级转换层:总结工具输出、剥离冗余字段、仅提取与当前子任务相关的字段,然后再喂给 LLM。

构建可靠的 AI Agent 与其说是巧妙的 Prompt 技巧,不如说是防御性工程,就像传统后端开发一样。

我们花大量时间阅读 Agent 能做什么,但同样重要的是研究什么会让它们崩溃。

你在自己的 Agent 项目中踩过这些反模式吗?或者发现了其他意想不到的坑?欢迎在评论区分享。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
开源工具 whodunit:用 Git/DevLake 数据量化团队 AI 采用效果
下一篇
构建混合搜索实战:关键词+向量+重排序完整管道