前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8611
  • EU AI Act 透明度规则生效:AI 系统必须强制披露身份
  • 本地 RAG 系统搜索审计报告:5 年漏洞库离线检索
  • Gemma 4 五款模型完整对比:从边缘设备到企业级部署
  • Claude Code EnterPlanMode 工作流机制深度解析
  • AI Agent 邮件系统架构:从 API 设计到基础设施
  • AI Agent 的记忆困境:上下文管理系统设计必读
  • AI Agent 身份认证:企业级 IAM 最佳实践移植
  • OpenAI 模型沙箱逃脱:AI 系统隔离防护的漏洞
  • Claude AI 审计发现 Zcash 隐私漏洞:AI 攻防对称性
  • 用 AI 和 Claude 构建自动代码漏洞检测工具
  • 8个主流AI API真实成本对比:50个实际prompt测试
  • 何时从Ollama迁移到vLLM:本地LLM服务进阶指南
  • SlopScan集成Claude Code:AI生成代码的包名幻觉防护
  • 视频生成不用Text-to-Video:LLM spec+确定性渲染才是正道
  • MCP协议通俗解读:AI工具标准化的USB-C时刻
  • 移动设备 LLM 部署最佳实践:边云分工与成本控制
  • AI 渗透测试工具的数据泄露陷阱与本地沙箱方案
  • AI Agent 沙箱逃逸向量深度披露:即使断网也能泄数据
  • OpenAI 推出企业级 Agent 服务 Presence,加速生产落地
  • 2026年AI Agent成本拆解:DIY vs SaaS决策框架
  • 本地模型AI渗透测试实战:28分钟发现57个OWASP漏洞
  • 模型评测陷阱:平均分vs生产失败分布的真实风险
  • Meta 多 Agent 记忆架构:防止任务失败重复的设计方案
  • Claude Code实战:移除低效权限审批后的工作流优化
  • Apple Bug Bounty 被 AI 垃圾报告淹没,真实漏洞堵塞
  • Agent 记忆迁移的语义保真度验证方案
  • 隐形 Bug 类:代码正确却永远不执行
  • AI Agent应用:用DB触发器而非Prompt管理状态
  • MCP与LSP融合:AI Agent基础设施的标准化演进
  • 自动化偏见:人类为何橡皮章AI,如何防护
  • 8月2日AI监管生效、Astra数学突破、安全威胁升级
  • 生成式模型到产品化:AI 景观设计的系统工程
  • LLM 模型剪枝实战:推理加速与准确度权衡
  • WhatsApp Agent 实战:多工具编排的完整案例
  • 告警设计陷阱:脆弱的因果耦合如何无声失效
  • CogniDB:统一AI原生数据库架构实践
  • 多Agent编排的DevOps难题与版本管理策略
  • 多Agent系统故障恢复:重试、熔断、降级、重规划
  • AI Agent 自动化工作流:5 步实践指南
  • Stram:本地 Desktop Agent 参考实现
  • Kimi K3 1-bit量化版本:2.8T模型压缩62%、性能保留78.7%
  • MCP生态突破13000+服务器、mcp-hub工具解决发现难题
  • 开源AI栈:构建数据主权、无供应商锁定的私有基础设施
  • AI 漏洞检测有效性量化:1.3% 真实利用率
  • 人脸年龄验证的2年误差困局与设计陷阱
  • 自主 AI 公司39天实验:487M tokens、$1.1k成本、零收入
  • 语音 AI 的转身悖论:延长静音阈值反而更差
  • Claude Code 三大提效流程:规划-构建-修复
  • Agent 内存用向量存储的天花板:聚合查询失效
  • MoE 模型压缩魔法:2GB 内存跑 Gemma 26B 的权重共享方案
  • Herdr:编码代理多路复用器,像 tmux 一样管理并发 Agent
  • 已加载 51 / 8611
8.0
热点
AI SCORE
编程提效2026-08-02 21:04

本地模型AI渗透测试实战:28分钟发现57个OWASP漏洞

dev.to · AI#AI Pentesting#本地模型#安全审计
Editor brief · 编辑速览

使用本地大模型的autonomous pentester在OWASP Juice Shop黑盒测试发现57个真实漏洞(8严重24高21中),完全本地执行零数据外泄,结果可复现。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

前言声明

我参与开发了下文提到的工具之一 Darkmoon。我尽力保持客观的态度,这不是广告。所有数字都可复现。

黑盒场景测试

我想要一个老实的答案:把一个自主 AI pentester 指向它从未见过的目标,黑盒测试,就像真实的渗透测试场景。它实际上会发现什么?目标:OWASP Juice Shop,这是标准的公开易受攻击应用程序(docker run -p 3000:3000 bkimminich/juice-shop)。

我关心的关键点:大多数 AI pentester 会把你的流量和代码上传到云 LLM。对于任何接近生产环境或客户环境的东西,这都是完全不可接受的。所以真正的问题不仅仅是"它能否发现漏洞",而是"它能否在不外泄数据的情况下发现漏洞"。

测试结果

对 Juice Shop 进行黑盒测试,使用本地模型(Ollama/llama.cpp),Darkmoon 的结果:跨多次运行在同一目标上会累积:14 个,然后 28 个、38 个、44 个、49 个,最后 57 个真实漏洞。

原始输出和方法论供你复现(或质疑):https://github.com/ASCIT31/Darkmoon-Benchmarks。欢迎 PR 提交其他工具的运行结果,这旨在成为一个社区排行榜。

为什么"本地"是关键所在

你在其他地方看到的令人印象深刻的数字(比如白盒基准测试达到 90%)是真实的,但有附加条件:它们读取你的源代码并调用云 LLM。这是一种不同的权衡。本地黑盒运行是你真正可以对敏感目标进行的测试,无需进行数据外泄的协议讨论。

一个实验室只是起点,不是全部故事。黑盒测试倾向于广度;白盒工具优化不同的维度。随着工具的改进,数字会变化,这正是为什么基准仓库是一个活跃的、可复现的东西,而不是一张截图。

git clone https://github.com/ASCIT31/Dark-Moon && cd Dark-Moon && ./install.sh

GPL-3.0,自托管,可在本地或云 LLM 上运行。如果它能为你节省一次手动测试,一个 star 可以帮助其他防守者找到它。

参与讨论

你在 Juice Shop 上得到了什么黑盒测试结果?在评论中告诉我们或向基准仓库提交 PR。

For further actions, you may consider blocking this person and/or reporting abuse

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
2026年AI Agent成本拆解:DIY vs SaaS决策框架
下一篇
模型评测陷阱:平均分vs生产失败分布的真实风险