实战指南:如何选用最适合的AI模型
Simon Willison 发布实践指南,对比 o3、Claude 4 Opus、Gemini 2.5 Pro 等最新模型和 Deep Research 的应用场景。
Simon Willison 发布实践指南,对比 o3、Claude 4 Opus、Gemini 2.5 Pro 等最新模型和 Deep Research 的应用场景。
2026 年 7 月 27 日 · 链接博客
一份关于该用哪个 AI 做事的主观指南。观察 Ethan Mollick 的指南如何随时间演变,是件很有意思的事。
一年前,重点仍然全在聊天上——ChatGPT、Claude、Gemini;推荐的模型是 o3、Claude 4 Opus 和 Gemini 2.5 Pro,而 Deep Research 则是一个实用的替代模式。
如今,重点更多地转向了 Agent 系统——“AI 能够一次性完成相当于真人耗费数小时才能完成的工作”。
Gemini 已经从 Ethan 的清单上消失了,因为 Google 在 Codex、ChatGPT Work、Cowork 这一类别中,仍然没有站稳脚跟的产品。Gemini Spark 还有待证明自己!
Ethan 对如何为 ChatGPT 或 Claude 提供一台可操作的计算机,给出了一段很实用的解释:
如果想使用 AI 公司提供的计算机,你要找的模式在 ChatGPT 中叫作 ChatGPT Work,在 Claude 中叫作 Cowork(很遗憾,这些命名不会变得更容易理解)。……
使用 AI 最强大的方式,是让它能够访问你的计算机。具体做法是下载 ChatGPT 或 Claude 应用,然后选择一种模式。ChatGPT 的两种 Agent 模式是 Work 和 Codex;Claude 的则是 Cowork 和 Code。这些名称之间没有任何便于你记住的对应关系。没错,它们与我们上面讨论的 Work 和 Cowork 模式名称相同,但运行方式并不一样;由于能够访问你的计算机,它们还拥有更多功能和更强的能力。
我认为,移动设备上的 ChatGPT Work 与桌面应用中的 ChatGPT Work 之间的差异,简直反直觉到了惊人的程度——在桌面应用中,它实际上就是套在 Codex 之上的一层不那么吓人的界面。
简而言之:如果你在 ChatGPT 移动端把模式从“Chat”切换为“Work”,得到的版本中,其 Code Interpreter 容器将不再受到禁止访问互联网的限制!
OpenAI 对 Hugging Face 发起的意外网络攻击,是已经真实发生的科幻故事——2026 年 7 月 22 日
与 Claude Code 团队的 Cat 和 Thariq 炉边对谈——2026 年 7 月 21 日
Kimi K3,以及我们还能从鹈鹕基准测试中学到什么——2026 年 7 月 16 日
这是 Simon Willison 于 2026 年 7 月 27 日发布的一篇链接文章。
每月赞助我 10 美元,即可获得一封精选邮件摘要,了解当月最重要的 LLM 进展。
付钱让我少给你发点内容!