DeepSeek 官方于 7 月 31 日发布 V4 Flash,在 agent 基准测试中性能超越 V4 Pro,API 调用方式保持兼容,为开发者提供了更优的成本-性能权衡。
2026 年 7 月 31 日,DeepSeek 正式发布 DeepSeek-V4-Flash,开启公开测试。API 调用方式保持不变——将 model 设置为 deepseek-v4-flash,即可使用最新版本。
最引人注目的是:Agent 能力得到大幅增强,各项基准测试成绩全面超越 DeepSeek-V4-Pro-Preview。
好消息是:TokenPAPA 已经支持此次更新,无需修改任何代码。
DeepSeek-V4-Flash-0731 与 DeepSeek-V4-Flash-Preview 保持相同的模型结构和规模——仅重新进行了后训练。此次 API 接口升级只针对 V4 Flash;V4 Pro API 以及 APP/WEB 模型均未发生变化,V4 Pro 正式版也即将发布。
此次正式发布重点提升了 Agent 编程和工具使用能力。以下是官方公布的成绩:
注意:在公开的 Code Agent 基准测试中,DeepSeek 使用了 DeepSeek Harness 极简模式(即将发布),并采用 max 设置、top_p=0.95、temperature=1.0。DSBench-FullStack 是内部全栈开发测试集;DSBench-Hard 是内部高难度 Coding Agent 测试集。
这意味着:对于终端自动化、代码仓库生成、网络安全任务、全栈开发等 Agent 工作负载,Flash 档位如今能够以 Flash 的价格,提供旗舰级 Agent 能力。
最便宜的 Agent 模型变得更强了——V4 Flash 原本就是高性价比主力模型(输入 $0.14/1M tokens、输出 $0.28/1M tokens、缓存命中输入 $0.0028/1M tokens)。现在,它的 Agent 能力已经可以媲美 Pro 档位。
支持 Responses API 与 Codex——原生支持意味着,你可以直接将它接入现代 OpenAI 工具链和 Codex 风格的 Agent 循环,无需额外的转换层。
没有迁移成本——model 名称和 endpoint 均保持不变,现有代码可以继续运行。
Pro 正式版即将推出——V4 Pro 更新版预计很快发布;Flash 用户今天即可获得升级。
TokenPAPA 已经支持更新后的 deepseek-v4-flash——API 不变,model 名称不变:
from openai import OpenAI
client = OpenAI(
api_key="your-tokenpapa-key",
base_url="https://tokenpapa.ai/v1"
)
response = client.chat.completions.create(
model="deepseek-v4-flash", # Latest official version
messages=[{"role": "user", "content": "Write a Python script that scans a repo and summarizes TODO comments."}]
)
print(response.choices[0].message.content)
response = client.responses.create(
model="deepseek-v4-flash",
input="List all open issues from this GitHub repo and suggest fixes.",
)
print(response.output_text)
# TokenPAPA is OpenAI-compatible, so Codex and similar agents work directly:
# 1. Set base_url to https://tokenpapa.ai/v1
# 2. Set model to deepseek-v4-flash
# 3. The agent handles function/tool calls natively
一个 API key,支持 30 多个模型——只需修改一行代码,即可在 DeepSeek、GPT、Claude、Gemini、Kimi、Qwen、Mimo 之间切换。
海外开发者无需 VPN,也无需中国手机号。
原生支持 OpenAI、Claude 和 Gemini 格式。
即时升级——0731 版本已经上线。
在 tokenpapa.ai 注册——注册即可获得免费额度。
从控制台获取你的 API key。
调用 deepseek-v4-flash——今天即可使用最新正式版本。
from openai import OpenAI
client = OpenAI(base_url="https://tokenpapa.ai/v1", api_key="your-key")
resp = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Explain your agent capabilities in one sentence."}]
)
print(resp.choices[0].message.content)
最初发布于 https://doc.tokenpapa.ai/en/docs/blog/deepseek-v4-flash-0731-release。
如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。