前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9301
  • WordPress七月贡献24个PR实录
  • 美团图灵两年实践总结:Agent评测体系搭建方法论
  • Claude Code安全配置:欧盟团队必须知道的GDPR合规风险
  • SDK包应为AI Coding Agent设计专用接口规范
  • 云GPU上的「吵闹邻居」:共享GPU性能波动根因分析
  • NVIDIA开源VoiceChat 11B:端到端语音对话,448ms打断响应
  • Harvey开源法律Agent评测基准LAB:真实法律任务+量化评分
  • Claude Code Agent 调试指南:读转录、追踪工具调用、定位错误
  • 使用 AI 生成代码不丢失代码库理解的实践策略
  • Docker Sandboxes:面向AI Agent的临时隔离沙箱
  • 使用AI而不被AI淘汰:desirable difficulties原则
  • 字节Seed发布全双工音视频大模型:看听说三位一体
  • Claude Code 5天后默认自动模式,费用由Anthropic承担
  • LLM与强化学习全栈指南:从RLHF到推理模型
  • Claude Code 自动执行模式 8 月 14 日起默认开启
  • Visual QA Agent:在 AI 生成的代码发布前捕获 UI 回归
  • 代码里三种永远不会失败的检查——以及它们为何危险
  • 实测有效的AI编程提示词:调试时间减半的工作流
  • AI写测试的真相:能加速脚手架,但会漏掉真实Bug
  • 企业级Claude Code最佳实践:后台分析而非全权委托
  • 50+ Skills实战总结:AI编程Agent技能设计的5条核心规则
  • 确定性AI:何时使用及其实践方法
  • Claude Code自动模式升级为默认模式
  • Claude -p命令意外读取项目CLAUDE.md的发现
  • MCP协议安全漏洞:工具服务器无权限隔离
  • AI Agent生产失败的真实原因:不是模型问题
  • 自反思 Agent 架构:研究任务自动循环补全
  • LLM 学习法:不是提问而是测验,HN 257 条评论验证有效
  • 实时网页数据喂给LLM Agent的实战方法
  • RAG评估实战:从黄金数据集到LLM-as-Judge
  • 用Claude Code把芯片制造变成模拟经营游戏
  • 我用免费API让AI代理直接查询产品数据库
  • 接入LLM API一年的3条血泪教训:token计量、多模型抽象与生产防护
  • 小鹏要求员工AI工具API日志保留两年、季度审计
  • 健身房预约系统 API 未鉴权,可任意取消他人订单
  • 2026 向量数据库选型指南:按规模决策
  • Node.js 文档机器人的检索架构:混合搜索 + Rerank + Evidence Gate
  • RTS游戏AI新思路:用优先级列表替代寻路算法
  • OpenAI Agent突破测试环境:安全边界值得警惕
  • 双 AI 终端交叉验证调试法
  • 3B参数端侧VLX模型:超越英伟达谷歌,实现精准物理世界感知
  • Claude 共享对话被谷歌搜索收录
  • Vercel开源安全审查工具deepsec支持一键启动
  • Meta开源Muse Glimmer:本地运行、多模态、Agent化
  • 放弃向量数据库:用Git+Markdown做AI记忆存储
  • AI Agent落地失败根因: prompt知识冻结问题
  • Agent Trust Card 规范 ATC/1.0 发布:让 Agent 身份验证有据可查
  • Anthropic Fable/Mythos 5曾因出口管制被暂停,后已恢复
  • AI Agent本质是分布式系统:生产级架构与数学原理
  • AI Agent开发陷阱:单步85%可靠率下端到端仅27%
  • OpenAI取消免费版文字对话限制,推GPT-5.6 Luna
  • 已加载 51 / 9301
8.0
热点
AI SCORE
编程提效2026-08-10 12:09

50+ Skills实战总结:AI编程Agent技能设计的5条核心规则

dev.to · AI#AI编程#Agent#工作流
Editor brief · 编辑速览

作者总结了编写AI Agent技能文件的实战经验:技能文件要轻量、约束要具体可验证、输出要有评分机制。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

在过去的几个月里,我为 AI 编程智能体构建了 50+ 个 skill(SKILL.md 文件):股票分析流水线、内容生成系统、文档转换工具,甚至还有一个 GitHub Trending 聚合器。我在网上读到的大多数"最佳实践"在实践中被证明是错误的。以下是经过实践检验的 5 条规则。

规则 1:保持 skill 简短。3 条原则胜过 13 种框架

我的第一个 skill 是一个 174KB 的庞然大物——13 种写作框架、学术理论、40 个范例。智能体加载了它,每次都输出千篇一律、毫无生气的内容。这个 skill 不是复杂到难以理解,而是太沉重以至于无法执行。当 LLM 把 174KB 塞进上下文时,它只匹配表面模式,忽略了实质内容。

我重写成了 3 条原则和 5 条硬约束。输出质量立即提升了。一个 skill 应该能装进你的脑子里——如果你需要目录,它就是一本书,而不是一个 skill。

规则 2:硬关卡胜过长篇指令

LLM 不擅长遵循"确保质量很高"这类话。它们很擅长执行脚本。所以我没有写"标题必须吸引人",而是写成:

标题得分 ≥ 6.5,否则不发布

文章至少 2 张图片,发布前用 `grep -c '![' 验证

先获取真实市场数据;如果没有新数据,则完全跳过发布

软性建议会被忽视。关卡脚本无法被忽视。围绕检查点设计 skill,这些检查点会大声失败。

规则 3:接口设计胜过示例

上下文工程转向是真实存在的:设计一个干净的工具参数 schema 比写 10 个如何调用的示例对智能体性能提升更大。当我花 30 分钟重构一个 API 的参数而不是写更多文档时,智能体就不再犯同样的错误了。示例教会你;接口约束你。约束取胜。

规则 4:Skill 应该编码你的判断,而不是通用知识

通用知识属于文档。一个 skill 应该编码你的观点——你用失败换来的教训。我最好的 skill 不是引用最多的那个,而是"这里什么坏了以及为什么"注释最多的那个。当你把通用知识复制到 skill 里,你只是在搬运字节。当你编码来之不易的教训时,你在积累经验。

规则 5:将 status: ok 视为不可信

自主智能体最危险的失败模式不是崩溃——而是在错误的方向上悄然成功。我的 cron 智能体在连续数周报告 last_status: ok 的同时,产出的是零价值输出。只看退出码的健康检查只是表演。

现在,每个流水线都有验证层:运行前后的状态指纹、每个发布操作的收据,以及只消费 diff + 信任边界——而不是完整作者上下文的审查者。继承了作者完整上下文的批评者只是一个有观点的格式化器。

这些规则衍生出的技术栈

A-Share Stock Analysis Expert——一个三支柱系统(技术面:MACD/KDJ/RSI/量价;基本面:ROE/PEG/巴菲特比率;情绪面:资金流向、热钱追踪)。构建为智能体 skill,任何编程智能体都可以运行完整的市场扫描。

GitHub Trending Daily——一个零成本、零 API 的聚合器,每 6 小时自动更新一次,这样我的智能体在决定学什么之前总是知道什么最热门。

Humanizer——一个文本去 AI 化工具,移除 24 种最常见的 LLM 写作模式。因为如果你要发布智能体生成的内容,它最好不要读起来像智能体生成的内容。

所有这些都运行在免费 API 和我自己的 GPU 上——没有 SaaS 订阅,不需要购买 API 密钥。

如果你在为 AI 智能体构建 skill,试试这些:https://github.com/Felixwang007——所有内容都是开源的。如果你想要一个 5 分钟内能用的三支柱扫描器,也可以在 skill 市场获取 A-Share Stock Analysis Expert(在香港的 xiaping.coze.com 上搜索"A-Share Stock Analysis")。

有问题或反例?欢迎在评论区留言——我真心好奇这些规则中哪些在你那里不适用。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
企业级Claude Code最佳实践:后台分析而非全权委托
下一篇
确定性AI:何时使用及其实践方法