DeepSeek 开源轻量级 V4-Flash 模型(304B 参数),编码性能媲美 Claude Opus-4.8,定价仅 $0.14/M input tokens,成本压力直指编程 Agent 市场。
DeepSeek 于 7 月 31 日开源了 V4-Flash-0731。这是一款拥有 304B 参数的模型,在 VulcanBench 上取得了 82.7 分,以每百万输入 token 仅 $0.14 的价格,达到了 Claude Opus-4.8 的水平。
DeepSeek 于 7 月 31 日开源 V4-Flash-0731,在 VulcanBench 上取得 82.7 分,与 Claude Opus-4.8 持平。这款 304B 参数模型的价格比 V4-Pro 预览版低 65%,每百万输入 token 仅需 $0.14。
2026 年 7 月 31 日以开源形式发布
304B 参数,相当于 V4 671B 参数的 45%
VulcanBench 得分:82.7,与 Opus-4.8 持平
定价:每百万 token 输入 $0.14、输出 $0.28
Hugging Face 趋势榜:24 小时内升至第 2 名
DeepSeek 于 2026 年 7 月 31 日将 V4-Flash-0731 作为开源模型发布。这是一个拥有 304B 参数的轻量版本,DeepSeek 称其性能超过了自家的 V4-Pro 预览版。据 Pandaily 报道,该模型在 VulcanBench 上取得了 82.7 分,登顶排行榜,并在最高性能梯队中与 Anthropic 的 Claude Opus-4.8 持平。
该模型的定价为每百万输入 token $0.14、每百万输出 token $0.28,大约只有 V4-Pro 预览版价格的三分之一。这种激进的定价,让 DeepSeek 以大宗商品级成本提供旗舰级性能,直接瞄准 coding Agent 市场——目前该市场由 Claude Code 及其 Opus 4.6 后端占据主导地位。在 Hugging Face 上,该模型发布后 24 小时内便升至趋势模型榜第 2 名。
304B 的参数规模尤其值得关注:它大约只有 V4 671B 总参数量的 45%,但 DeepSeek 声称其在 VulcanBench 上仍达到了最高梯队的水平。该 benchmark 用于测试 Agent 式编程和工具使用场景。根据 Anthropic 公布的数据,在同类测试中,搭载 Opus 4.8 的 Claude Code 在 Terminal-Bench 2.1 上取得了 78.9% 的成绩。
VulcanBench 的 82.7 分只是一个单一数值,DeepSeek 并未披露完整的评测方法,也没有公布多次运行结果之间的方差。DeepSeek 同样没有说明自托管这款 304B 模型所需的硬件配置——对于正在权衡本地部署与 API 使用方案的企业而言,这是一个不容忽视的信息缺口。据 Pandaily 报道,此次开源发布包含模型权重和推理代码,但不包含微调脚本或训练数据。
这是 DeepSeek 第三次重塑性价比曲线,此前两次分别是 2024 年 12 月发布 V3,以及 2025 年 1 月发布 R1。每次发布都迫使西方 AI 实验室在成本方面作出回应。Anthropic 的 Opus 5 于 8 月 1 日发布,价格只有 Opus 4.6 的一半,这表明相关压力可能已经开始显现。
接下来需要关注第三方评测机构能否独立复现 VulcanBench 82.7 分的结果,以及 Anthropic 是否会下调 Opus 4.8 的价格,或加快 Opus 5 正式版(GA)的推出。同时,也应关注企业对自托管 V4-Flash 的采用情况。DeepSeek 尚未披露硬件规格,而这将决定实际部署成本。
最初发布于 gentic.news。
如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。