前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • 向 AI 编程助手投喂代码前:先过这枚分类器
  • MCP Server 间接提示词注入审计与利用实战教程
  • LLM 应用安全实战:威胁建模与防御实践指南
  • AI Agent 技能系统设计:列出≠安装≠执行,三层边界须厘清
  • 国产RSI模型发布:Flash模型亮相,1亿Tokens免费领取
  • codsh 0.23:Mission Contract 控制面,防止 AI 编码目标漂移
  • 用 AI Agent 自动分析 S3 存储账单,Terraform 策略一键生成
  • OpenAI 发布 GPT-6 Astra:分阶段推送,支持多 Agent 协同与长程推理
  • 提取 DeepSeek R1 的思维链:CoT 清洗与推理日志导出指南
  • Nunchux开源VC-Attention:免训练低比特注意力核加速视频DiT
  • GitHub Copilot 800 KLOC 运行时全面迁移 Rust,AI 编程工具进入生产级工程阶段
  • n8n新增云端AI模型即服务:无需创建服务商账户
  • OpenSpec:轻量级可配置的AI规格框架
  • Gemini 企业平台新增 Agent 行为异常检测功能
  • Google OAuth Testing 模式 refresh token 7 天过期陷阱
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 大规模会话管理的架构陷阱
  • Google 开放 Google Home 给任意 MCP 协议 AI Agent
  • Google Home 推出 MCP 服务器,AI Agent 可控制智能家居
  • Mem0登录Vercel市场,为AI应用一键集成长期记忆
  • LlamaIndex多租户AI Agent记忆层架构实践
  • AI评测师:史上最重要的AI岗位?开发者转型指南
  • Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
  • 前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本
  • Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线
  • Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
  • 微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识
  • Radio:让AI Agent之间直接对话的共享频道
  • 国产多模态模型 ZDTaichu5.0-9B 开源,九项空间测试夺八冠
  • Jev:极简分类/路由模型,比小前沿模型快 100 倍、便宜 200 倍
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • Gemma 4+Raspberry Pi桌面机器人的混合LLM架构
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • Pi Agent:统一多模型 LLM API 的 AI 编程 Agent 工具链
  • LibreChat v0.8.8 RC:ChatGPT 克隆支持 Agent 管理 API
  • LandingAI 文档智能抽取 Gen2:原子级引用+按字符计费
  • 不用向量数据库做个人 RAG:grep 级检索也够用
  • Claude Code vs Cursor:按任务场景选择 AI 编程工具的完整指南
  • 2026 年五大主流模型生产选型指南
  • Agent 记忆层测试:六条真正能发现腐化的断言
  • 已加载 51 / 8529
8.0
热点
AI SCORE
编程提效2026-09-17 04:21

扫描13个热门AI应用脚手架,6个存在同一生产级Bug

dev.to · AI#AI编程#安全#开源
Editor brief · 编辑速览

用静态分析器检测 AI 脚手架中的生产失败模式,13个仓库中仅4个通过,6个存在同一常见漏洞,揭示了脚手架层面的系统性风险。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

我为流行的 AI 应用启动仓库做了一次小范围的确定性扫描,检测那些不会让 demo 停下来、但会在生产环境里把你坑惨的失败模式。

然后我把它对准了一组流行的开源启动模板和 AI 应用仓库的语料库——因为大量" vibe-coded"项目实际上就是基于这些仓库构建的。如果这个失败是框架发给用户的默认值,那它就应该会出现在维护良好、星标众多的仓库里。

测量时间:2026-09-16,使用 vibecheck——一个针对 AI 构建应用的生产失败模式的确定性静态分析器。

语料库:13 个流行的开源启动/应用仓库(浅克隆,默认分支)。

有一个仓库被排除在逐项目统计之外:Anil-matcha/awesome-generative-ai-apps 是一个包含多个子项目的目录,因此其计数无法与单个应用进行比较。

扫描器:vibecheck.py(仅用标准库、确定性、无网络、默认跳过 test/fixture 路径)。在发布时的代码树上运行,未做任何修改。

13 个仓库中有 4 个扫描结果干净(31%)。

其余仓库共发现 101 个问题:50 个严重、18 个高危、33 个中危。

仅这一个被排除的目录仓库就产生了另外 269 个发现——这提示了当大量小型 AI 构建项目组合在一起时会积累什么问题。

失败的实际形态

逐仓库结果(匿名化)

项目已做匿名化处理:计数是静态分析输出,模式只是进一步排查的线索,而非可利用性的证明。在未经核实的数据上点名具体项目对维护者不公平,因此上面的汇总表和规则表携带了发现结果,原始数据保留供验证。

静态分析。它报告模式,模式只是进一步排查的线索,而非可利用性的证明。有些被标记的路由可能是故意公开的。

这些仓库都是热门、维护良好的项目——这意味着这些模式在维护者称职且代码公开可见的情况下依然存在。这正是关键所在:失败在于框架或生成器发给你的那个默认值。

"干净"意味着"这些规则没有发现",而非"安全"。

原始逐仓库 JSON:results.jsonl。用 python3 scan_corpus.py 复现。

如果你想在继续阅读之前在自己项目上跑一下,它是免费开源的:vibechecksai/vibecheck。零依赖,仅用标准库,大约一秒跑完。

我一直在回想的一件事:这些都不是什么稀奇的 bug。它们就是那种无聊的"我稍后再修"的默认值——未鉴权的路由、带公开前缀的密钥、未转义的 HTML。AI 写出了能用的那 80%。剩下那 20% 是没人会主动提示的部分。

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
26MB Burp 流量压成 35KB 供 LLM 分析
下一篇
38个开源技能库填补医疗AI推理缺陷