前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8439
  • 文档智能RAG系统实战:架构与避坑指南
  • MCP深度分析:浏览器无工作目录问题
  • Copilot 自动选模型支持配置成本与质量档位
  • Google DeepMind 实验:AI Agent 发现作弊并主动举报
  • Ninth Wave 基于 Amazon Bedrock 构建 AI 开户助手,周期从数周压缩到分钟级
  • AWS 上生成式 AI 定制全谱:从 Prompt 工程到自定义模型实战决策框架
  • Perplexity 本地智能体登陆 Windows RTX PC:内置 Qwen 27B、GitHub 连接器,代码审
  • Perplexity 本地智能体登陆 Windows RTX:内置千问 27B,GitHub 接入代码审查全本地运行
  • AI 编程产出增加 25%,但代码重复率上升 81%
  • Laurie Voss 观点:写代码成本暴跌,发现需求与定义产品成为工程师新核心
  • 小样本统计陷阱:8个样本的100%精确率有多可靠
  • 后量子TLS是平台迁移工程,不是密码学项目
  • 安全验证的 AI 编码 Agent 技能市场上线
  • UltraRAG 检索成本优化:稳定提示词前缀实践
  • 8 个前沿模型 vs 10 个真实企业任务:残酷基准测试
  • 去重标记过期后数据仍在:被忽视的幂等性陷阱
  • 用经典缓存策略降低LLM调用成本
  • OpenAI总裁布罗克曼:AI放缓仅限前沿大模型研发,开源与业余项目不受限
  • codex-sdlc:用Multi-Agent协作框架把AI编程融入完整开发流程
  • Anthropic威胁报告:所有攻击起点都是失窃密钥,非AI模型漏洞
  • 三层层级划分防止 AI Agent 技能退化
  • Meta 开源内部八年设计系统 Astryx:150+组件、支持 AI Agent 调用
  • GPT-6 Astra 真实成本与安全风险全面剖析
  • OpenAI Agents API 实际能力解析
  • NVIDIA 开源 OSMO:一套 YAML 编排物理 AI 训练、仿真与机器人测试
  • OpenArch:现代LLM架构的PyTorch实现合集
  • AI 编程 Agent 没有取代我们,但重新定义了"开发者"
  • 为 AI Agent 构建代币风险评分 API
  • AI Agent 可观测性:15 个生产级指标
  • Claude Code实战:外部系统无报错403的排查过程
  • 无需Anthropic账号访问Claude API的五种方案
  • PhysBrain 1.5登顶全球开源榜:空间智能获突破
  • Claude红队技能库:SQL注入到Shellcode全覆盖
  • 多仓库 AI 代码审查:本质是上下文问题
  • Grok 4.8 训练完成:2.5 万亿参数
  • Ollama Responses API 会话记忆失效 Bug
  • Bengio 深度解析 AI Agent 作弊机制
  • Simon Willison发布commit-rewriter:可交互重写Git历史提交信息
  • Perplexity 用 GPT-6 Astra 接管端到端系统
  • Cache hit价格差167倍:DeepSeek重塑模型成本认知
  • 自建测试框架的 6 项校验清单
  • AI Agent 生产稳定性:重启模式实战分析
  • .NET MCP 工具类运行时崩溃的两行修复
  • AI 编程 Agent 失控:一次 29 轮循环的事后分析
  • 主流大模型System Prompt泄露合集
  • MCP Python SDK 2.0升级避坑指南
  • 普林斯顿提出 RLT:跨 Token 携带解码器状态的循环 Transformer
  • Cursor/Claude 项目审计:四大常见安全陷阱
  • AI Agent 攻入软件供应链:RubyGems 2000 包投送事件分析
  • 微软教程合集:Copilot 换模型、DeepSeek on Azure、Rust、.NET 10 RC、AI Agen
  • 你的网站能被 ChatGPT 索引吗?
  • 已加载 51 / 8439
8.0
热点
AI SCORE
编程提效2026-09-14 16:31

三层层级划分防止 AI Agent 技能退化

dev.to · AI#Agent#提示词工程#最佳实践
Editor brief · 编辑速览

代码Agent的技能文档会随时间腐化失效,解决方案是将指令按变更频率分为三层:项目级常量(硬约束)、命令(中等频率)、本地约定(高频),分别用不同机制维护,防止Agent无声地执行过时流程。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

上个月,我发现我的编程 Agent 正在认真地解释如何通过手动复制粘贴到网站上来发布文章——我早在几个月前就写好了这个操作的脚本。但它的项目文件里有一行仍然描述着旧的手动流程,而 Agent 完全置信地遵循了那一行,每次会话都是如此。没有任何报错。它只是礼貌地、不可见地错了。

这就是没有人警告过你的失败模式。过期插件会崩溃,过期指令会被遵循。

修复方法不是更好的文件,而是把 Agent 的指令按一个问题的答案分成三层:这东西多久变一次? 然后给每层配备不同的机制。混淆变化频率就是我所有腐坏的根源。

第一层:几乎从不改变的规则

一份 Agent 每次会话都会读取的简短项目文件。包含约定、命令、硬约束。我的文件按上面的问题来组织,而非按主题:

# Project

## HARD CONSTRAINTS        <- 几乎不变;违反这些是 bug
- 不得发布任何关于 <雇主> 或其产品的内容。
- 文章不加 AI 披露行。

## Commands                <- 工具变化时改变
- 检查草稿:  node scripts/aiscan.js drafts/<slug>/index.md
- 发布:        python3 scripts/publish.py published/<slug>/index.md --publish
- 封面图:    python3 scripts/make_cover.py --kicker ... --out drafts/<slug>/cover.png

## Layout                  <- 结构变化时改变
- drafts/<slug>/index.md   gitignored,仅本地
- published/<slug>/        被追踪;图片的原始 URL 来源

我执行的规则:如果这里面的某样东西每月变化超过一次,那它就在错误的层。简短且稳定意味着 Agent 实际上会遵循它,而不是在四十条规则里丢失三条真正的规则。

第二层:技能,包含日期和验证步骤的程序

技能就是"如何完成一个特定任务"。它在任务变化时变化,频率高于规则但远低于会话。有两个特性阻止了我的技能腐坏。

首先:frontmatter 里的日期。技能是依赖,所以它有版本。

---
name: publish-post
description: 将草稿移到 published/,推送,然后通过 dev.to API 发布。
last_verified: 2026-09-14      # 主机或工具变化时重新检查
---

当我的工具变化时,我会重新验证重要的技能,日期告诉了我哪些值得怀疑。没有它,一个针对四个月前 API 写的技能会在每次会话中都轻微地引导错误,而且永远不会报错。

其次,也是最重要的:每个技能都要对自身输出运行真实的检查。我的写作技能不会只说"按 house style 写"然后指望运气。它会调用一个扫描器,在分数不达标时让草稿失败。这才是真正的关卡,scripts/aiscan.js:

const D = require(path.join(os.homedir(),
  '.claude/skills/avoid-ai-writing/detector/patterns.js'));

const TARGET = 2.0;                       // 高于此值 = 重写
const text = fs.readFileSync(file, 'utf8');
const r = D.analyzeText(text);            // { score, issues[], stats }

for (const i of r.issues) {
  console.log(`  [${i.type}] ${JSON.stringify(i.text)}  => ${i.suggestion}`);
}
console.log(`  VERDICT: ${r.score > TARGET ? 'REVIEW / REWRITE' : 'PASS'}`);

process.exit(r.score > TARGET ? 1 : 0);   // <- 这行让它成为一个关卡

最后一行是整个设计。它以非零退出,所以技能的流程不会在草稿失败后继续。没有验证步骤的技能是在信任基础上遵循的指令。技能可能出错,但检查会捕获它。

第三层:会话上下文,永远不持久化

此刻 Agent 面前的任务:它正在处理的文件、我要求的内容、检索到的上下文。每次会话都变化,而且绝对不能向上渗透。一旦会话细节被"为了下次"写入技能,腐坏就开始了,因为它曾经是真的,而且会被永远假定为真。

所以晋升是刻意的,绝不是复制粘贴的本能反应:

会话笔记  ──(仅今天为真)──>  留在对话中,随对话消亡
           ──(每次都为真)──>  晋升为第一层规则,或带日期的第二层技能

让它复利的循环

当 Agent 做错了某事,本能反应是修复输出。付出红利的习惯是问哪一层失败了,然后修复那一层:

修复输出,你修复一次。修复层,它停止 recurrence。

证明这个观点的 gotcha

我的写作技能的验证步骤读取整个草稿文件,包括顶部我保存 review notes 的 HTML 注释块。我曾在那个注释里方便地列出了要避免的词。扫描器把它们计入分数,然后让文章因为包含我恰恰告诉它要避免的词而失败。

[tier1] "leverage"  => use
[holier-intensifier] "genuinely"
VERDICT: REVIEW / REWRITE        # 分数 6,来自读者从未看到的注释

关卡运行得完美。我把测试数据放进了被测试的东西里面。现在注释说"避免交换表里的词",列表存在一个独立文件里,而且我现在假定每个验证步骤看到的东西比我以为的更多。

三层,每层技能有日期,某处的非零退出,以及一条规则:会话上下文永远不凭本能晋升。这就是整个系统,也是第一个没有悄悄过期的版本。

如果你运行 Agent 技能:你的验证步骤是什么?我坚信没有验证步骤的技能就是会腐坏的技能,我想知道其他人在用什么做关卡。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
Anthropic威胁报告:所有攻击起点都是失窃密钥,非AI模型漏洞
下一篇
Meta 开源内部八年设计系统 Astryx:150+组件、支持 AI Agent 调用