前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8529
  • OpenSpec:轻量级可配置的AI规格框架
  • Gemini 企业平台新增 Agent 行为异常检测功能
  • Google OAuth Testing 模式 refresh token 7 天过期陷阱
  • Stanford 发布 Paper2Agent:把科研论文自动转成可验证的 AI Agent
  • Perplexity AI Agent 建数据库却无运行权限:一次真实的 AI 工作流权限管控教训
  • GLiFormer:5.75亿参数Encoder刷新嵌套JSON提取榜单
  • 信息窃取日志暴露 AI 平台会话令牌绕过 MFA
  • 26MB Burp 流量压成 35KB 供 LLM 分析
  • 扫描13个热门AI应用脚手架,6个存在同一生产级Bug
  • 38个开源技能库填补医疗AI推理缺陷
  • EKS上NVRx实现秒级故障恢复的分布式训练
  • AI 加速开发流水线实战:Spec-Driven + GitHub Actions + Claude Code
  • Agent 循环的瓶颈不是 Token,是反馈机制
  • 大规模会话管理的架构陷阱
  • Google 开放 Google Home 给任意 MCP 协议 AI Agent
  • Google Home 推出 MCP 服务器,AI Agent 可控制智能家居
  • Mem0登录Vercel市场,为AI应用一键集成长期记忆
  • LlamaIndex多租户AI Agent记忆层架构实践
  • AI评测师:史上最重要的AI岗位?开发者转型指南
  • Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
  • 前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本
  • Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线
  • Gemini 3.8 Live 支持异步工具调用,3.5 Transcribe WER 低至 2.6%
  • 微软 AI 负责人公开质疑 Anthropic:别让 Claude 模仿人类意识
  • Radio:让AI Agent之间直接对话的共享频道
  • 国产多模态模型 ZDTaichu5.0-9B 开源,九项空间测试夺八冠
  • Jev:极简分类/路由模型,比小前沿模型快 100 倍、便宜 200 倍
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • Gemma 4+Raspberry Pi桌面机器人的混合LLM架构
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • Pi Agent:统一多模型 LLM API 的 AI 编程 Agent 工具链
  • LibreChat v0.8.8 RC:ChatGPT 克隆支持 Agent 管理 API
  • LandingAI 文档智能抽取 Gen2:原子级引用+按字符计费
  • 不用向量数据库做个人 RAG:grep 级检索也够用
  • Claude Code vs Cursor:按任务场景选择 AI 编程工具的完整指南
  • 2026 年五大主流模型生产选型指南
  • Agent 记忆层测试:六条真正能发现腐化的断言
  • Agent 生成的限流器如何绕过多租户隔离测试
  • 周末 Agent 项目攻略:用permit文件管控写操作
  • squash-merge 后 HEAD~1 指向无关代码的 Agent bug 分析
  • Vibe coding安全指南:防止AI应用密钥泄露
  • AI 生成的 Schema 变更:别让自由派 Diff 绕过锁
  • AI 写的代码编译过了,但环境变量、锁文件、日志全踩坑
  • Skild AI S1:仅凭一段视频,机器人学会翻煎饼
  • Java 27 发布:后量子 TLS 与对象头压缩等 9 项 JEP
  • DeepSeek 算子负责人自述:AI 一年内从查文档到独立优化 CUDA 算子
  • 编程任务 LLM 大模型盲测:4 款模型代码质量实测
  • Agent 循环常见路径陷阱自查清单
  • 你的 CDN 可能正在偷偷屏蔽所有 AI 爬虫
  • 已加载 51 / 8529
8.0
热点
AI SCORE
模型发布2026-09-16 23:19

前 OpenAI 研究员推出纯分类 AI 模型:70ms 响应、极低 token 成本

The Decoder#开源#AI模型#分类任务
Editor brief · 编辑速览

TypeSafe AI 发布一款不做任何文本生成的模型 Jev,仅输出软件分类结果,响应时间从 70ms 起,token 价格极低,适用于软件分类任务。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

TypeSafe AI 初创公司打造了一款名为 Jev 的 AI 模型,与典型的聊天机器人不同,它不是在软件内部生成文本,而是提供快速的判断和概率。其承诺的优势是速度和成本,但局限性也很明显。

TypeSafe AI 推出了一款名为 Jev 的 AI 模型,与典型聊天机器人采取了不同路线。Jev 不生成文本、邮件或代码,而是被设计成在其他程序内部提供狭窄的判断和概率。联合创始人兼 CEO Diogo Almeida 曾任职于 OpenAI,是 InstructGPT 研究的作者之一,该研究为 ChatGPT 奠定了基础。

Jev 的核心思路:开发者定义问题和可能的答案,模型对各选项打分。

对请求进行分类,而不是回复客户

文档中的一个示例展示了它在实践中可能的样子。一位客户写信给一家在线商店,说自己被收取了两次订单费用,要求退还第二次付款。在任何人处理该请求之前,必须先对其进行分类。它是关于支付问题、配送问题还是退货问题?客户是想退款,还是只是想得到解释?

这时开发者将商店软件与 Jev 连接,定义这些问题以及允许的答案。每当有新消息时,软件将客户的文本交给 Jev。它返回的不是一封回复信,而是一个标签比如"支付问题",以及客户想要退款的概率。

然后商店软件可以附加固定规则。支付问题转给财务部门,退款请求被标记。当标签不明确时,由工作人员审查请求。Jev 提供评估,软件则根据预设规则决定后续操作。

这并不意味着钱就能退回来。是否真的存在重复扣款,还需要随后与实际交易记录核对。可以用一个独立的聊天机器人告知客户确认后的状态。但对于分类这个环节来说,并不需要用到聊天机器人。

亚秒级响应时间可能开辟新的应用场景

TypeSafe 表示 Jev 的响应时间在 70 到 500 毫秒之间,比目前最快的语言模型还要快好几倍。为了实现这一速度,模型跳过了逐步的文本生成,而是并行计算多个输出。在同一次调用中增加更多问题几乎不会增加响应时间。

这种速度可以在 AI 助手的每次回复之前都进行检查。草稿是否与对话上下文矛盾?是否声称了一笔客户账户中没有记录的退款?TypeSafe 在其示例工作流中描述了这类检查。该公司在销售和客服领域列出了更多可能的使用场景,比如识别购买意向、按主题对请求进行分类,或者判断何时应该由人工接管。

但常规语言模型同样可以输出预设类别和数据结构。OpenAI 为此提供了 Structured Outputs。仅仅一个结构化响应格式并不能让 Jev 从竞争中脱颖而出。要赢得市场,该模型不仅要更快或更便宜地处理这些任务,还要有足够好的质量。

已发布的性能测试存在局限性。TypeSafe 比较了四个自己构建的工作流,并使用其他 AI 模型的回复作为参考,而非独立验证过的正确答案。GPT-6 Astra 也未出现在评估中。不过该模型非常便宜。TypeSafe 列出的价格是每百万输入 token 0.042 美元。它声称对输出不收取任何费用。

不产生幻觉不等于不出错

TypeSafe 将 Jev 定位为一款不会幻觉的模型。但这一保证仅涵盖允许的输出结构。模型不会产生预设选项之外的答案。在这些选项之内,仍然可能出现事实上的错误选择。

该模型旨在使后台的众多小型判断更加经济。这些判断是否足够可靠,需要各公司针对自己的任务进行测试。开发者目前只能通过候补名单获取访问权限。

Original source

本文由 AI 翻译整理自 The Decoder,原文版权归原作者所有。

阅读英文原文
上一篇
Amazon Bedrock AgentCore:生产追踪自动优化 Agent 系统提示词
下一篇
Bedrock Data Automation 实战:构建无服务器 PII 自动脱敏流水线