8.0
热点
AI SCORE
编程提效2026-09-13 03:38
Check:给 Claude Code 加幻觉防护层
dev.to · AI#Claude#幻觉防护#开源
Editor brief · 编辑速览
在命令执行前读取本地环境并验证每个 AI 生成的命令是否真实存在,测试中最高提升 41% 准确率,发布全部原始数据和研究偏差声明。
AI 幻觉有两面:模型知道什么,以及模型能验证什么。
知识是困难的。2026 年最前沿的模型在开放域事实知识上只得了 43 分(满分 100)。推理模型反而让情况更糟。o3 的幻觉率为 33%,而 o1 只有 16%。这个问题至今无人解决。
验证是容易的。你机器上某个命令存在就是存在,不存在就是不存在。某个路径是真实的就是真实的。这些不是观点。它们是你在命令运行前就可以查证的事实。Claude Code 不会去查。
而 Check 会。它在 AI 推理之前先读取你的机器,并在每个命令运行前进行验证。两个钩子。不碰你的项目任何代码。
我们构建的工具位于 AI 与它所触及的地方之间。Check 是第一个。它处理验证这一面,因为这一面是我们真正能解决的。我们不是要让模型变得更聪明。我们是要让环境变得足够诚实,让聪明的模型不再需要猜测。
我们测试了两次。一次得分提高了 41%。一次 AI 自我审查说没有任何区别。两份结果我们都发布了,同时还有四个声明的偏见和三种可以证伪的方法。这就是我们认为公司应该发布产品的方式。
完整文献综述、案例研究和研究方法见 golproductions.com/research。
每天 120 次免费检查。无需注册,无需信用卡。Windows、Claude Code、Node 18+。
npx @golproductions/check@latest --install

我们是程序员分享、保持最新和拓展职业发展的地方。