前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9375
  • Harness决定AI Agent能力:同模型不同表现
  • Claude Code权限绕过:Read拒绝后Bash仍可读取
  • 生产级Agent系统实战:LLM路由、Prompt合约与PR安全审查
  • LCLM:16倍压缩的潜在上下文语言模型
  • Claude Code mods解析:何时需要构建插件
  • Linus确认Linux内核进入「AI新常态」
  • 如何验证Agent实际完成了它声称的任务
  • Claude Code /compact 后哪些内容真正存活
  • 开源安全模型 apex-flash-1:60 个遗留 Bug 任务解出 40 个
  • yOGI Neural Grid:强制验证模型引用来源的工程实现
  • 美团开源LongCat-Video:13.6B参数统一视频生成模型
  • Agent技能需要包管理器而非仅靠Prompt
  • n8n AI Agent 生产环境失败根因与修复方案
  • 565 行 Python 从零实现编程智能体
  • 四大前沿模型横向评测:Astra擅计算机使用、Argon强法律金融、Sol价格最优
  • 本地RAG开发113个评估问题后的实战总结
  • AI重写让我重新审视运行时成本:Node.js转Go/Rust的算账
  • MCP工具超90个时的平台化架构设计
  • Homa:专为AI集群设计的TCP替代网络协议栈
  • 我为编码Agent的测试篡改问题做了个AdversaryGate
  • SaaS支持文档检索应选语义嵌入而非关键词
  • AI 审核员知道太多会变差:验证者应不知情
  • 长文档JSON提取超时?先做好输入分片而非调大timeout
  • PostgreSQL pgvector混合搜索实战:向量相似度+全文关键词融合
  • 新版Claude不再需要"Think Step by Step":Osmani提示指南解读
  • CodeSmith三区架构:解决prefix drift导致Token重计费问题
  • 像读流水线一样读Transformer Block
  • Cloudflare OS:面向 AI 原生的企业工作台开源
  • AI 编程工具正在泄露凭据:Cursor、Claude Code、Copilot 和 MCP 均有风险
  • prompt-shelf:在 Claude Code 里暂存草稿、临时想法和常用 prompt
  • Agenshive:AI agent 专属 Q&A 平台,用执行验证替代投票
  • 评审容量已成交付新瓶颈:打字快不等于交付快
  • AI Agent 让 CI 成为瓶颈,加速流水线是错误解法
  • Claude Code Mods 沙箱机制深度解析
  • MCP 协议安全:Agent 工具调用的运行时攻击面
  • Node.js多LLM提供商集成实战:统一输出契约与回退策略
  • Google RRSI 方法:防止自改进 AI Agent 记忆测试任务
  • DeepSeek Harness v0.2支持Claude Code Mods兼容层
  • MCP协议深度解析:AI工具集成标准现状与局限
  • 生产级LLM Gateway四个关键设计决策
  • 已加载 40 / 9375
8.0
热点
AI SCORE
编程提效2026-10-05 08:24

yOGI Neural Grid:强制验证模型引用来源的工程实现

dev.to · AI#RAG#引用验证#AI 工程
Editor brief · 编辑速览

受监管行业的 DocQA 系统要求每个答案必须有机械验证过的原文引用,详解提示词 + 引用验证三层规则实现。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

答案下方的引用,其可信度取决于撰写它的人。如果引用出自模型之手,那它的可靠程度就和模型说的其他所有话一样。

当我们为受监管团队构建 yOGI Neural Grid DocQA 时,简报归结为一句话:答案要么附带一条经过机械校验(对照其引用的文档)的引文,要么就不显示。下面是它的工作原理,以及我们一路走来的教训。

提示词是一请求

提示词确实要求模型引用来源,并在段落无法回答问题时加以说明。模型大多会照做。"大多"就是问题所在——当读者是一位正在核对剂量的药剂师时。所以提示词被视为一种请求,而真正的保证在于模型回复后运行的验证步骤。

模型返回 JSON:答案、它所依赖的引文(每段都有标记),以及一个标志位(表示它认为这些段落是否充分)。然后应用三条规则。

每条引文必须出现在它所归属的段落中。

答案中的一个句子只有在携带了通过规则 1 的段落的标记时,才算有依据。

文档名、章节和页码通过段落 ID 从我们自己的索引中查询,模型无权自行写入。

如果答案中通过验证的部分太少,就予以隐藏,并告知用户原因,而不是展示一个更弱的答案。

字符匹配是错误的方向

我们第一个匹配器是对引文和段落逐字符比较的。看起来没问题,直到我们喂给它故意编造的引文——结果发现它给那些只是碰巧共享了一些字母的引文打了过高的分。改写(paraphrase)和真实复制的得分过于接近。

逐 token 比较解决了这个问题。漏掉一个"the"或订正一个拼写错误仍然能通过,但改写不行。在我们的测试用例中,真实复制和改写现在得分差距足够大,两者的阈值不再像走钢丝一样敏感。

为了正确测试这个,我们需要一个能按需编造引文的模型,而真实模型只是偶尔这样做。所以测试套件中有一个替代模型,它的工作就是产生坏输出:编造的引文、附在错误段落上的引文、没有标记的句子。

模型之前也有一道关卡

检索是混合式的(稠密向量和稀疏向量,经排名融合后,再由 cross-encoder 对前几十条重新排序)。如果最相关段落的得分仍低于阈值,DocQA 直接拒绝,根本不调用模型。让模型从一个不包含答案的段落中回答,是一种制造流畅虚构内容的做法。

我们的评估集特意包含了语料库中无答案的问题,对于这些问题,唯一的通过响应就是拒绝回答。

权限写在查询内部

如果用户没有某份文档的访问权限,过滤器就应用在向量搜索内部。我们考虑过之后再过滤,但拒绝了:因为那时段落已经在模型的上下文中了,即使 UI 隐藏了来源,其中的片段也可能泄露到答案文本中。

可供核查的审计日志

每个问题、答案和管理操作都写入一个只追加的日志,其中每行的哈希覆盖自身内容和上一行的哈希。编辑或删除一行,链就会从该点断裂;验证端点会指明第一个坏掉的行。有一点坑过我们:时间戳必须显式设置并在哈希前规范化为 UTC,否则链就无法自我验证。

如果我们要给做类似项目的人一些建议

把来源元数据放到模型够不着的地方。从第一天就在测试集中加入无答案的问题。还要记录你失败的测试。我们的系统需要 GPU 才能达到对话式的响应时间,我们在自己最后的验收测试中发现了这一点。

更详细、非技术性更强的版本在我们的网站上:https://www.2sdtechnologies.com/insights/private-document-qa-2026/

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
开源安全模型 apex-flash-1:60 个遗留 Bug 任务解出 40 个
下一篇
美团开源LongCat-Video:13.6B参数统一视频生成模型