Deepseek V4 Flash最新更新性能已接近OpenAI最新模型但成本仅为60%。这是LLM成本竞争的重大转折,直接影响开发者的模型选型。
Deepseek 发布了 V4 Flash "0731",这是对其预算级 AI 模型的重大升级。根据 Artificial Analysis Intelligence Index,新版本得分为 50 分,比 2026 年 4 月发布的前一个 V4 Flash 高出 10 分。这使其仅比 OpenAI 的预算级模型 GPT-5.6 Luna 低 1 分,但即使在 OpenAI 降价 80% 之后,成本仍然低约 60%。这个差距的主要原因是 Deepseek 的 98% 缓存折扣,远高于行业标准的 90%。该模型的 token 使用量也比前一版本少 12%。
Artificial Analysis Intelligence Index 显示 Deepseek V4 Flash "0731" 更新后得分为 50 分,几乎与 OpenAI 的 GPT-5.6 Luna 相当,同时在价格与性能比方面排名第一。| 图片来源:Artificial Analysis

与前一个版本相比,该模型在所有测试类别中都有改进,在 agentic 任务中获得最大收益。在 GDPval 基准测试上——一个设计用来在复杂真实办公工作上测试模型的基准——它的 Elo 分数从 1,189 提升到 1,559。它的幻觉也更少。架构保持不变:2840 亿个总参数,130 亿个活跃参数,100 万 token 的上下文窗口。模型权重可在 Hugging Face 上以 MIT 许可证获得。
AI 新闻无夸张修辞 – 由人类策划
订阅 THE DECODER 以获得无广告阅读、每周 AI 新闻通讯、我们独家的"AI Radar"前沿报告(每年六次)、完整的归档访问权限和我们评论区的访问权限。