8.0
热点
AI SCORE
编程提效2026-08-07 00:33
四种智能体框架的速度与成本实测
The Decoder#Claude Code#OpenCode#Agent
Editor brief · 编辑速览
Composio 使用 DeepSeek V4 Flash 在四种智能体框架上测试了30项真实任务,各框架成功率接近,但单任务成本相差近3倍。OpenCode 最便宜,Claude Code 最快但成本最高。
AI 模型外层的软件封装会对使用成本产生重大影响。AI 工具公司 Composio 使用 DeepSeek V4 Flash,在四种 Agent 框架(Claude Code、Codex、OpenCode 和 Oh My Pi)上测试了 30 项任务,涉及 Gmail、GitHub、Slack 和 Notion 等真实世界工具。没有任何一个框架能在所有类别中胜出。Oh My Pi 的成功率最高(17/30),但速度最慢,每项任务耗时 272 秒。OpenCode 的成本最低,每项成功任务仅需 0.073 美元;Claude Code 的速度最快,仅需 122 秒,但成本也最高,达到 0.195 美元——尽管它调用工具的次数最少,生成的输出 token 也最少。
在四种 Agent 框架上,使用 Deepseek V4 Flash 测试了 30 项真实世界任务。各框架的成功率相近,但成本和速度差异显著。| 图片:Composio via X

虽然有 7 项任务能否通过完全取决于运行它们的框架,但各框架的整体成功率仍然相近。只有 OpenCode 略微落后,成功完成了 30 项任务中的 14 项。真正显著的差距体现在成本和速度上:不同框架之间的价格差距接近 3 倍,速度差距则达到 2.2 倍。
订阅 THE DECODER,即可享受无广告阅读、每周 AI 新闻通讯、每年六期独家前沿报告「AI Radar」、完整文章归档,以及评论区访问权限。