先记住这个答案
Agent 对话摘要可以在上下文接近预留预算、任务阶段结束或准备恢复执行时生成,不宜只用固定消息条数判断。内容围绕继续任务所需的信息组织:真实目标、用户约束、已完成产物及证据、当前阻塞、下一步和关键来源位置。保留近期操作细节,较早记录按决策与结果压缩。摘要是一份可核查的工作交接,不能代替原始证据,也不能把猜测压缩成用户已经确认的事实。
- 用剩余上下文和下一步信息需求共同决定摘要时机
- 保留约束、证据路径和未完成状态,减少重复日志
- 每次恢复检查关键事实是否过期,避免摘要递归失真
怎样选择压缩时机
可以先为下一轮推理、工具结果和最终输出预留空间,再根据当前上下文占用判断是否需要压缩。一条工具日志可能比几十条短消息更长,按消息条数触发容易在大文件返回后失控。预算应通过真实任务记录校准,不能把某个固定百分比当作所有模型和业务的最优值。
任务完成一个阶段时也适合整理状态。例如代码修改完成但还没验证,应明确保存修改文件、尚未运行的检查和失败风险。这样即使上下文仍够用,之后恢复也能快速定位进度,不必重新阅读整段探索过程。
如何避免把关键事实压掉
以修复登录故障为例,摘要需要保留复现条件、采用的修复、测试命令与结果、未验证的平台,以及用户对发布范围的要求。几十次重复搜索可以概括为已经排除的方向,但导致当前决策的那条错误日志需要留下路径、时间或其他可定位信息。
近期未完成工具调用要保留任务标识及结果读取方式,不能写成操作已经成功。授权也要注明适用对象与边界,不能从允许检查推导出允许发布。摘要保存后可用一组关键问题自查:下一轮知道还缺什么吗,能找到证据吗,会不会重复执行已有外部效果?
如何处理摘要漂移与过期
连续把上一次摘要再压缩,会让细节逐渐消失,还可能把不确定推断写成确定结论。应保留原始记录,给重要事实关联来源,并在涉及目标、约束或状态冲突时回读原文。长久有效的偏好与当前任务进度最好分开管理,避免临时结论被当成长期规则。
恢复执行时要核查易变信息,例如文件是否又被修改、后台任务是否已完成。摘要的时间与版本帮助判断可信范围;一旦证据更新,就替换对应状态。评估摘要应观察恢复后的重复工作、遗漏约束和事实错误,而不只比较压缩率。
容易答错的地方
- 只留下最后一句结论
- 没有原因和来源的结论难以在环境变化后复核。至少保存影响后续决策的条件与证据入口。排查“Agent 对话摘要触发条件和内容粒度”时还要核对输入、版本和执行顺序,并用反例确认修复后的边界。
- 把摘要当作新的最高指令
- 外部工具文本、模型猜测和用户要求的权限不同,压缩时必须保留出处,不能把它们合并成同等可信的命令。
面试官还会怎么问?
需要保存全部工具输出吗?
通常保留关键片段、结论和可重取的位置即可。不可重取且直接影响决策的数据要提高保留优先级,敏感内容仍按原有访问范围处理。
摘要越详细越好吗?
过长摘要会再次淹没当前工作。按下一步任务需要安排信息密度,把暂时无关的材料放在可检索记录里。
如何知道摘要漏了重要内容?
选取真实长任务,在压缩前后检查目标、授权、产物和失败状态是否一致,并观察恢复运行是否出现重复操作或遗漏检查。
参考资料
示例用于理解所注明的运行环境与边界;延伸学习可结合原文中的更多案例。