DeepSeek V4官方定价分峰值/非峰值时段,同模型输入成本在0.22至0.44美元/百万token间波动;经不同渠道商价格另有差异。
定价页在骗你(某种程度上)
DeepSeek 的 V4 不是一个价格,而是四个价格。你最终付哪个,取决于大多数开发者从未刻意做过的那些决策。
以 V4 Flash 为例,这是一款便宜的主力模型。DeepSeek 官方列出价格是 $0.33 输入 / $0.99 输出每百万 token——但这不是你实际会付的。DeepSeek 采用高峰/非高峰计费:非高峰时段按挂牌价 ×0.67($0.22/$0.66),高峰时段按 ×1.33($0.44/$1.32)。所以同样的 API 调用,凌晨 3 点输入每百万 token 花费 $0.22,下午 2 点是 $0.44。相同的模型、相同的 token,相差一倍。(具体的时段划分以及如何对应你的时区,见我的非高峰定价详解。)
而这只是 DeepSeek 自身门户的定价。同样的模型 ID 还在其他地方被转售:
是的,你没看错 OpenRouter 那行。OpenRouter 上最便宜的主机提供 deepseek-v4-flash-0731,价格是 $0.05/$0.16——大约是 DeepSeek 非高峰费率的四分之一。对于 Pro(deepseek-v4-pro-0813),最便宜的渠道是阿里巴巴,价格 $0.58/$1.74,实际上比 DeepSeek 自身的非高峰费率还要低。
所以你的账单上会是哪个数字?这取决于三个选择:
1. 官方 vs. 转售商:这是一场缓存博弈,不只是价格博弈
按 token 计价的表格显示"转售商胜出"。但在切换之前,先看看缓存定价:DeepSeek 官方的缓存命中收费 $0.007–$0.044/M——比任何转售商提供的都便宜得多。如果你的应用复用长 prompt(RAG 带着庞大的系统 prompt、Agent 带着大型工具 schema、长对话线程),你在 DeepSeek 官方的真实账单可能远低于简单的 per-token 估算值,有时甚至低于转售商的宣传价格。
我总结出的经验法则:高缓存命中 workload → 官方;无状态、prompt 多样化的 workload → 最便宜的转售商渠道。
2. 高峰时段是调度问题,而调度是免费的
DeepSeek 的非高峰折扣是整个 AI API 市场中最便宜的优化,因为它不牺牲任何代码质量。批处理任务、评估运行、嵌入回填——它们都不在乎是凌晨 3 点还是下午 2 点运行。如果你的 Flash token 有一半是批处理形态,将它们移到非高峰时段就能将这部分成本减半(每百万输入 $0.22 vs $0.44——两倍的差距)。
Pro 模型让这个差距更加显著:官方 Pro 从非高峰的 $1.98/M 输出到高峰的 $3.96/M。你的夜间推理批处理和中午的交互流量不是同一种产品,不应该共享一个价格。
3. 关注模型 ID,而不是营销名称
一个值得单独说明的陷阱:在 OpenRouter 上,未标注日期的 deepseek-v4-pro ID 路由价格从 $0.87/$1.74 起——高于 DeepSeek 自身的非高峰费率——而标注日期的 deepseek-v4-pro-0813 通过阿里巴巴起步价是 $0.58/$1.74。相同的模型,不同的 ID,不同的路由池,不同的底价。按模型 ID 选择,并检查哪个主机实际服务该路由;OpenRouter 的"最便宜主机"会变化,且每条路由的定价并不统一。
算算你自己的账
我网站上的计算器接受你每月的输入/输出 token 量,然后返回两个模型在各个提供商那里的总价,其中内置了高峰/非高峰的中间值计算。给你一个规模感:在相当典型的个人项目负载下,Flash 每月 10M 输入 / 5M 输出 token,OpenRouter 最便宜主机与 DeepSeek 高峰时段官方价格的差距大约在每月 $1 到 $11 之间。对于 Pro,同样的差距是几十美元。
表格中需要注明的一点:Krater.ai 是订阅制(每月 $20,350+ 模型 1,500 信用额度),所以被排除在 per-token 比较之外。如果你的使用量不稳定而是突发性的,订阅可能胜过上述所有 per-token 费率——但那是另一种算法问题了。
"DeepSeek V4 价格"是一个区间,不是一个数字:官方从非高峰 ×0.67 到高峰 ×1.33,而转售商在 Flash 上甚至比非高峰费率还低 4 倍。
这些提供商的价格经常变动——我会定期对照官方页面和仪表盘重新核实,一旦有变动就会更新计算器。如果这里的数字看起来过时了,计算器页面是最新版本。
本文同时发布于 ai-info.fastget.link,我的 AI API 定价与决策网站——本文的规范版本在那里。