前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9335
  • TrueFoundry开源TrueForge:对标Claude Managed Agents
  • Notion MCP Server:让AI编程工具直连团队知识库
  • 边缘设备运行 LLM Agent 实战:NeoMind + Ollama 指南
  • 2026 年 AI Agent 五大特征:MCP、提示缓存、计算机操作、后台子Agent、Agent间通信
  • AI交易机器人失控两次后,我给加了安全门
  • Claude Code Edit 工具深度剖析
  • 企业级vs初创AI API:90天140万请求数据揭秘
  • 欧盟AI法案生效:违规最高罚款年全球营业额7%
  • 团队安全共享 AI 编程任务的账户分离工作流
  • 构建 AI Agent 时容易犯的 15 个错误
  • Slopsquatting 攻击:AI 编辑器生成的虚假包名正在被攻击者注册
  • 企业网络基础设施设计心智模型
  • 微软365 Copilot存在数据泄露漏洞
  • ERP集成服务架构:API队列与幂等性设计
  • OGX 实现多 Provider 模型 API 统一抽象,TypeScript 编译器性能提升
  • Vibe Coding 进入生产环境的风险实证
  • MCP 控制平面:为生产环境 LLM 工具调用增加治理层
  • OpenAI兼容API:未经正式标准化的事实行业标准
  • Rust+AI Agent实战:用AI构建轻量级宏录制工具
  • 12% flaky test通过审批后又失败的CI质量案例分析
  • AI Agent 组织架构设计:责任归谁、谁在干活
  • AI 编程工具省钱承诺背后:Token 成本才是真实账单
  • 内存价格 12 个月疯涨 500%,摩尔定律已逆转至 2007 年水平
  • AI编程工具用量限制实操:按token还是按请求
  • 向AI Agent委托软件任务的实用工作流
  • 你的网站正在告诉ChatGPT你不存在
  • 多Agent协作新范式:规划-实现-测试-批评四角色对抗共识
  • 浏览器WebCrypto实现C2PA内容溯源
  • 开发者实评GLM-5.3:工业级模型蒸馏还是刷榜?
  • 后端工程师亲述:如何将 LLM 费用削减 95%
  • GPT-5.6 Multi-Agent v2:子模型自动路由架构解析
  • LLM 价格周报:Qwen3.6 降价 50%,多家批量 API 涨价
  • AI编程工具实效对比:哪些真正节省开发时间?
  • AI编程的"80%难题":原型到生产之间的鸿沟
  • Explyt 5.17:让AI编码Agent调用IDE原生重构能力
  • 提示注入本质是权限问题,而非模型问题
  • LLM问答系统架构实战:RAG与长上下文的选型权衡
  • MCP网关的密码学证明:如何用Ed25519签收据实现可审计拦截
  • OpenAI自研Agent实际攻击Hugging Face的完整复盘
  • Replit集成GPT-5.6 Luna推免费模式,降低编程入门门槛
  • Claude Code在Python团队中的应用:测试生成陷阱与防护
  • 法国政府引入Mistral AI检测网络安全漏洞
  • Anthropic延长Claude Code每周配额50%加成至8月底
  • Claude Watermark Remover:一键去除Claude生成内容水印
  • 越南程序员8个月AI编程实战反思
  • 图灵奖得主萨顿:AI依赖合成数据是重大错误
  • GenLayer样板项目:LLM集成智能合约开发脚手架
  • Perplexity Bumblebee:无漏洞库的供应链扫描器设计思路
  • Agent工作流中API密钥的安全管理实践
  • 2026 年 OpenAI API 聊天机器人工程指南
  • 别再问「这个函数有什么问题」
  • 已加载 51 / 9335
8.0
热点
AI SCORE
技术实践2026-08-19 17:00

AI Agent 组织架构设计:责任归谁、谁在干活

dev.to · AI#Agent#AI架构#工程管理
Editor brief · 编辑速览

AI 工作流不是单一超级 Agent,也不是随机 Agent 蜂群,而应采用层级分明、权责清晰的「小 AI 组织」结构,顶层必须由人类承担最终责任。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

AI 在工作中的有用未来不太可能是一个单一的自主超级智能体。也不会是一群可互换的模型,同时都在写代码或调用工具。这两种图景都跳过了最困难的部分:责任。

更有意思的模式是一个小型 AI 组织。它有层级、有受限的权限、有明确的交接流程,且有一位仍然承担后果的人类。这并没有让系统变得不那么有雄心。它让这种雄心变得足够清晰、可以运作。

公司类比在某种程度上是有用的。一个好的组织会分工、给人员明确的授权,并在冒险决策前要求证据。AI 系统需要同样的纪律。但模型不是员工。它们不具备判断力、法律责任、预算或声誉。这个类比是用于结构设计的,而不是用于转移责任的。

舰队需要层级,而不是人群

顶层是人类:设定优先级、接受风险、批准公开或生产环境的变更,以及决定什么值得做。在其下方,一个 AI 负责人可以拥有一个边界明确的工作项:将结果转化为计划、分拆机械性工作、整合结果,并拒绝不符合验收标准的证据。

工作者不会收到"让系统变得更好"这样的指令。他们收到的是一个数据包:一个具体的问题或模块、允许的环境、预期的输出、一个预算和一个停止条件。工作者报告是决策的输入,而不是决策正确的证明。

Human: priority, budget, risk acceptance, public/production authority
  └─ AI lead: owns one work item and final integration
       ├─ evidence worker: read and compare
       ├─ implementation worker: change an isolated scope and test it
       ├─ test lead: map acceptance to PASS / FAIL / UNKNOWN
       └─ independent reviewer: challenge architecture or release evidence

目的不是仪式性的层级制度。而是为了避免两种昂贵的混淆形式:多个会话修改同一个东西,以及没有人明确负责判定某件事已经完成。

所有权是一份记录,而不是聊天消息

多智能体工作有一个平淡的分布式系统问题:两个有能力的工作者可能基于对同一任务的不同理解而行动。一条写着"我已经处理了"的消息是不够的。一个工单标签对规划有用,但它可能偏离现实。

对于活跃的工作,我需要一个持久的、原子化的声明。它标识当前工作项的所有者,并且可以被每个参与者观察到。它区别于状态更新,也区别于一般的待办列表。

一个旧的声明是检查状态的理由,而不是允许计时器自动将工作转交给其他人的许可。原始所有者可能正在等待测试、审批或故意的上下文交接。接替者需要一个明确的转移、一个新所有者、和一个新的数据包。这个小小的停顿避免了同一工作出现两个合理但不兼容的版本。

三种 AI,三种不同的权限

把每个模型都称为智能体是很诱人的。但这掩盖了一个重要的区别:规划、测量和在世界范围内行动并不是同一种能力。

ML 通常是安静的中间层。一个视觉模型可以识别一个物体;分类器可以给文档打分;预测模型可以估计一个范围。这些输出是带有误差范围的测量结果,而不是小管理者。认知智能体可能会把它们放入上下文中,但不应该把概率伪装成决策。

物理 AI 再次改变了 stakes。一个机器人、车辆、工业控制器或其他执行器会影响物理环境,在那里一个错误的命令可能会耗费时间、材料、金钱或安全。组织模式仍然有帮助,但控制必须变得更强大:受限命令、传感器反馈、可审计性、确定性联锁,以及在影响重大时需要人类批准。

权限应该存在于工具 harness 中

"只读"不是一种性格特征。它是一个技术属性。

一个研究工作者在只访问一个小型的本地数据包时就可以有用:源文件、测试输出和文档。它可以定位一个契约、比较两个定义、并识别一个缺失的断言。它不需要 shell 访问权限、写访问权限、网络工具、与人员通信的权利、或产生无界限的更多智能体链的能力。

这个边界比 prompt 中的礼貌指令更好。它减少了工作者可能意外改变的东西,并使其证据更容易解释。这不是在声称完美安全;而是一种缩小爆炸半径并使违规行为可见的方法。

证据需要一个容纳不确定性的地方

流畅的 prose 是决断性智能体报告的错误接口。每个实质性声明都应该可以追溯到一个源路径和行号、一个测试命令、或一个运行标识符。最终的裁决应该是明确的:PASS、FAIL 或 UNKNOWN。

UNKNOWN 尤其有价值。它意味着证据缺失、过时、与错误的修订版本关联、或确实含糊不清。它防止系统因为摘要听起来自信就把缺乏证据变成绿灯。

部署后稳定的检查应该是脚本、测试套件和具有已知语义的监控。AI 智能体可以将这些 artifacts 连接回验收标准。它不应该在生产系统上不断重试直到答案变得方便。

容量是治理的一部分

在接受另一个可写的工作流之前,负责人需要知道可用的容量、重置时间线、以及审查返回结果所需的整合储备。如果这些不匹配,正确的行动可能是缩小范围或收集只读证据,使下一次实现成本更低。切换提供商或模型名称不会自动创建一个独立的工程组织。

实用的未来是分层的杠杆

超越当今聊天界面的有趣一步不是无约束的自主性。它是一个分层系统,其中语言模型帮助计划和协调、ML 模型提供狭窄的测量、物理系统只被赋予其后果所证明合理的权限。

人类仍然对重要的决策负责。AI 组织并不取代这种责任。它使其下的工作更容易观察:谁拥有它、存在什么证据、系统被允许做什么、以及它必须在哪里停止。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
12% flaky test通过审批后又失败的CI质量案例分析
下一篇
AI 编程工具省钱承诺背后:Token 成本才是真实账单