前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • Cline 开源编程 Agent:SDK/VS Code/JetBrains/CLI 全覆盖
  • Cloudflare 开源安全审计 Skill:把 AI 编程助手变成专业漏洞猎人
  • 744B MoE 模型能跑在普通桌面上的工程原理
  • Cloudflare 安全审计 Skill 最值得抄的设计:独立验证 Agent
  • AI 生成代码上线前审计:五个高频漏洞
  • VS Code 1.138发布:开发容器内运行AI智能体,Copilot订阅可切换
  • Apify MCP Server:2 分钟让 AI 操控真实网页爬虫
  • 五大 AI 编程工具的会话恢复能力全面横评
  • Agent 写的测试通过,不代表测对了
  • 向 AI 编程助手投喂代码前:先过这枚分类器
  • MCP Server 间接提示词注入审计与利用实战教程
  • LLM 应用安全实战:威胁建模与防御实践指南
  • AI Agent 技能系统设计:列出≠安装≠执行,三层边界须厘清
  • 国产RSI模型发布:Flash模型亮相,1亿Tokens免费领取
  • codsh 0.23:Mission Contract 控制面,防止 AI 编码目标漂移
  • 用 AI Agent 自动分析 S3 存储账单,Terraform 策略一键生成
  • OpenAI 发布 GPT-6 Astra:分阶段推送,支持多 Agent 协同与长程推理
  • 提取 DeepSeek R1 的思维链:CoT 清洗与推理日志导出指南
  • Nunchux开源VC-Attention:免训练低比特注意力核加速视频DiT
  • GitHub Copilot 800 KLOC 运行时全面迁移 Rust,AI 编程工具进入生产级工程阶段
  • n8n新增云端AI模型即服务:无需创建服务商账户
  • OpenSpec:轻量级可配置的AI规格框架
  • Gemini 企业平台新增 Agent 行为异常检测功能
  • Google OAuth Testing 模式 refresh token 7 天过期陷阱
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 已加载 34 / 8529
8.0
热点
AI SCORE
开源项目2026-09-17 15:41

Cloudflare 安全审计 Skill 最值得抄的设计:独立验证 Agent

dev.to · AI#Agent设计#安全审计#开源
Editor brief · 编辑速览

Cloudflare 开源的安全审计 Skill 核心亮点不是扫描规则,而是一条设计原则——验证 Agent 与分析 Agent 完全隔离、无记忆共享,避免「自我确认」式复核。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Cloudflare 开源了一个安全审计 Skill,它内部发现漏洞的 harness 就以此为基础构建。MIT 协议,不到三个月斩获 5,500 颗星。

它不是一个扫描器。它是一个 Skill——一个结构化指令文件夹,编码 Agent 加载后按指令行事。你把 Claude Code、Codex 或 Cursor 对准某个仓库,让它做安全审计,它就会通过六个阶段运行一批相互隔离的子 Agent。

安全这部分做得不错。真正值得抄的设计原则只有一条。

检查者和发现者不是同一个 Agent

问模型审查自己的输出,结果如何大家心里都有数。

一个刚用 4,000 token 力证某段代码存在漏洞的模型,下意识就会继续自证。让你 double check,它也只是在"验证"——以一种强化既有结论的方式。你得到的不是验证,而是同一观点的二次起草,而且因为已经"检查过"了,写得比第一次更有底气。

大多数项目用 prompt 里加一句"要保持批判性"来敷衍这个问题。这个项目直接封死了这条路。验证者是一个独立 Agent,全新 spawn,对产生候选结果的那场 hunt 毫无记忆。它不可能被一段从未见过的推理所 primed。

这是架构设计而不是指令注入,是"祈求严谨"和"强制严谨"的分水岭。如果你正在构建任何形式的 Agent 流水线,把这个抄过去。只要是一个 Agent 产出判断、另一个 Agent 负责验证的场景,验证者就应该冷启动。

三个判定,中间那个有它存在的理由

大多数扫描器给你一个 finding 或者沉默。这个系统给出三种状态:

needs_validation 是诚实系统对未竟之作的归处。一套工具只吐确认或什么都不吐,就必须在每个边界 case 上做沉默判决,而你是否漏掉了哪个永远无从得知。在这里,未完成的工作是可见的,且不携带任何 severity,所以它不会把报告撑到证据撑不起的程度。

保留 rejected 同样重要。重新运行时不会再烧掉一批 Agent 去重新发现同一个死胡同。

我把完整流程全部梳理了一遍——六个阶段、覆盖台账(coverage ledger)、攻击类库(attack class library),以及大多数人可能会跳过的 OS 级沙箱要求:Cloudflare's Security Audit Skill: an AI auditor built to disprove itself。

读 Agent 输出时我常开着两个工具:一个 JWT 解码器(用于 auth 类 finding),一个 JSON compare(用于对比两次运行之间的 finding 差异——这样就能看第二次审计实际新增加了什么)。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
744B MoE 模型能跑在普通桌面上的工程原理
下一篇
AI 生成代码上线前审计:五个高频漏洞