将简单任务(解释函数、写提交信息)路由至便宜的 Flash,复杂多文件推理留给 Pro,避免配额浪费。
这是个经典错误:把所有请求都默认发给最好的模型,结果在午饭前就把配额耗在鸡毛蒜皮的事上了——解释代码、小改动、查语法——等真正棘手的问题出现时,配额已经空了。
解决方案是按难度分配,而不是按习惯。但首先得搞清楚这两个 tier 到底有什么区别。
DeepSeek V4 Pro 是 DeepSeek 的旗舰推理模型——最高 100 万 token 上下文,支持多种推理强度。它专为复杂的多文件任务和长周期 agent 循环设计,在这类场景下一个错误答案意味着重来一遍。
DeepSeek V4 Flash 是它的快速、便宜兄弟——284B 参数的 MoE 架构,只有 13B 激活参数,针对高频、确定性任务调优:代码解释、commit 信息、单文件编辑、快速查询。速度更快、成本更低。
两者都通过 TeamoRouter 暴露,都有免费 tier——每个账号每天 200 次请求,重置,无须绑定信用卡:
deepseek-v4-pro-free → 多文件推理、长周期 agent 循环,任何「答错就要重来」的场景。
deepseek-v4-flash-free → 大量轻量工作:解释函数、commit 信息、单文件编辑、快速查询。
Pro 的价值在于一次做对。把它分配给:
多文件推理——跨模块变更,需要理解整个代码库。
长周期 agent 循环——构建 + 自测 + 修复,推理深度决定成败。
困难问题——难以复现的 bug、深入的架构问题。
每天 200 次 Pro 请求足以覆盖正常一天的困难任务——硬活本来就少而精,不是靠量取胜。
Flash 的价值在于又便宜又快,适合大量轻量的确定性工作:
每天 200 次的配额基本能消化所有这类请求。把手动的活交给 Flash,就能保住你的 Pro 配额。
if task == light (explain / small edit / commit / lookup):
use deepseek-v4-flash-free
elif task == hard (multi-file / long loop / high-stakes):
use deepseek-v4-pro-free
elif either quota == 0:
use the matching paid model
一旦某个免费 tier 用完,对应的付费模型没有账号级别的限额:
配额超了不会肉疼——顶多从零跳到几块钱。
两个免费 tier,每天各 200 次 → TeamoRouter