DeepSeek V4系列正式启用峰谷定价:V4-Pro输出token峰值价格达3.96美元/百万,是原价的4.5倍;同期OpenAI、Google却在降价,形成鲜明对比。
昨天,DeepSeek 的峰谷定价正式生效。V4-Pro 输出在峰时达到了每百万 Token 3.96 美元——是旧价格的 4.5 倍。以下是应对新格局的方法。
AI API 价格战陡然转向。8 月 17 日,DeepSeek 新的峰谷计费方式对整个 V4 系列(V4-Pro 和 V4-Flash)正式启用。峰时(北京时区 9:00-12:00 和 14:00-18:00)的费用是谷时的两倍——即使是谷时档,也比旧的统一费率更贵。
与此同时,市场上其他玩家的方向正好相反。OpenAI 将 GPT-5.6 Luna 降价 80%。Anthropic 取消了 Sonnet 5 原定 9 月的涨价计划。Google 以五折首发价推出了 Gemini 3.7 Flash。
结果呢?AI API 定价格局变得前所未有的复杂——也前所未有的有趣。
以下是新的 DeepSeek 费率表(美元/百万 Token):
所有人都关注的头条数字是 V4-Pro 缓存命中输入 Token 1100% 的涨幅。但实际情况更为微妙:
大多数报道都忽略了一点:对于与 UTC 对齐的工作负载,峰时只占 24 小时中的 7 小时。对西方开发者来说,北京时间的峰时对应 UTC 凌晨——这意味着你的批量任务、每日评估和异步 Agent 工作流本来就已经在谷时运行了。
真正的成本冲击在于那些必须在北京时间工作时间内实时响应的交互应用。如果你的用户在亚洲,你会感受到涨价。如果你的用户在北美或欧洲,有效涨幅更接近 50-130%,而非头条所说的 1100%。
1. 将延迟容忍的工作负载移到谷时
批量分类、每日摘要、数据标注、索引重建等任务都应该安排在 17 小时的谷时窗口内运行。
2. 多模型路由
这是最有效的单一策略。将不同任务路由到不同模型:
3. 缓存优化
缓存命中 Token 的涨幅最为陡峭。优化你的提示前缀以最大化缓存效率:
即使按峰时计价,DeepSeek V4-Pro($1.32/$3.96)仍然:
而当你把中国模型生态系统的低端选项考虑进来,差距更加惊人:
但有一个问题:从中国境外访问中国 AI 模型仍然需要中国手机号、支付宝,以及应对防火长城。2026 年了,这仍然是一道门槛。
这就是我搭建 TunanAPI(https://tunanapi.com)的原因——一个统一的 API 网关,让你访问 8 个中国模型:
当前阵容(美元/百万 Token):
DeepSeek 的峰时定价并没有改变基本盘:中国 AI 模型仍然是市场上性价比最优的选择。区别在于,现在你需要更聪明地选择何时使用以及如何使用它们。
2026-2027 年能够胜出的实验室,不会是拥有最便宜单一模型的那一家——而是拥有最智能的多模型路由策略的那一家。
你们如何应对新的 DeepSeek 峰时定价?是切换到谷时调度,还是路由到其他模型,抑或两者结合?欢迎在评论区分享你的想法。
通过一个 OpenAI 兼容的 API 访问 8 个中国 AI 模型,请访问 TunanAPI.com。免费积分起步——无需中国手机号。支持 PayPal。