8.0
热点
AI SCORE
模型发布2026-08-13 07:59
Simon Willison测评:DeepSeek V4 Pro推理能力差异化显著
Simon Willison#DeepSeek#模型测评#OpenRouter
Editor brief · 编辑速览
DeepSeek V4 Pro通过OpenRouter可用,三个推理强度档位(low/medium/high)产生明显不同的pelican图,基准数据来自Reddit被删帖子整理。
2026年8月12日
DeepSeek V4 Pro 0813(通过 OpenRouter)。最新的 DeepSeek Pro 模型现已上线,仅通过 API 提供。我不得不链接到 OpenRouter,因为 DeepSeek 官方似乎没有为他们的新模型设置任何明显的公告页面。
我目前无法确认他们是否计划发布开放权重,但考虑到今年四月和七月的模型(deepseek-ai/DeepSeek-V4-Pro 以及 deepseek-ai/DeepSeek-V4-Flash-0731)都开放了权重,似乎这是一个合理的预期。
有趣的是,我在低、中、高三种不同推理级别下获得了截然不同的鹈鹕图片。我从未在其他模型上注意到这种差异:



至于基准测试……据我所知,这些数据首先发布在 DeepSeek 官方微信群,随后被复制粘贴到 Reddit 的一条帖子中——该帖子因"低质量内容"被版主删除——之后又被复制到了 Hacker News 上的这个 ASCII 艺术表格中。
现在我们有了一条时间线:
OpenAI 意外攻击 Hugging Face 事件 — 2026年8月7日
用 Claude Fable 5 一击通关浣熊盗窃游戏 — 2026年8月5日
新版本 LLM 支持推理追踪、OpenAI Responses、服务端工具和更智能的日志记录 — 2026年8月4日
这是 Simon Willison 的链接帖,发布于 2026年8月12日。
赞助我 $10/月,获取当月最重要 LLM 动态的精选邮件摘要。
付费让我少发邮件给你!