OpenAI为GPT-5.6 Sol优化了回答聚焦度,并加入可调节思考深度的推理滑块。免费用户将主要使用能力较弱但不限文本对话次数的Luna模型。
OpenAI 正在为 Plus 和 Pro 用户提供更专注的 GPT-5.6 Sol,并新增一个可调节回答深度的滑块。免费用户则可以使用成本更低的 GPT-5.6 Luna 进行不限次数的文本聊天。
OpenAI 表示,GPT-5.6 Sol 现在减少了不必要的细节和过度格式化。面对简单问题时,它会直接给出答案,同时提供恰到好处的背景信息;处理更复杂的任务时,它会给出更完整的回答,但仍能让关键建议一目了然。
该公司还宣称,模型的事实准确性有所提高。在一项使用金融、医疗和法律 prompt 的内部评估中,与 GPT-5.5 Instant 相比,GPT-5.6 Luna 回答中至少包含一处事实错误的比例下降了约 62%,GPT-5.6 Sol 则下降了 68%。这些数据尚未得到独立验证。
此次更新仅适用于 ChatGPT。ChatGPT Work 和 Codex 中的 GPT-5.6 Sol 保持不变。
一个新的滑块允许付费用户调整 ChatGPT 为回答投入的推理强度。较低档位适合日常问题,较高档位则面向规划、研究和编程任务。此前,ChatGPT Work 已经提供了这一滑块。
OpenAI 表示,它希望快速回答与深度推理给人的感觉就像来自同一个模型,而不是两个语气不同的模型。OpenAI 的一位开发者最近详细说明了五个档位分别适合哪些类型的任务。该滑块可在网页端、移动端和桌面端使用。
不过,这些控制选项是否真的能帮助人们更好地使用 AI,仍然值得商榷。用户基本上不会使用模型切换器,而针对任务选择正确的模型,很可能远比在五种推理档位中进行选择重要。增加更多需要调节的旋钮,并不会让使用体验变得更好。
根据 OpenAI 的发布说明,GPT-5.6 Luna 将于本周晚些时候成为 Free 和 Go 用户的默认模型。不限次数的文本聊天,以及用于处理较难问题的新「Think」按钮,将于下周上线;不过,文件上传、图像生成和其他工具仍会受到额度限制。
以其参数规模而言,Luna 的表现或许不错,但小型模型通常更容易出错,可靠性也更低。此前 Instant 模型曾出现过一个案例:与更大的推理模型相比,它给出了完全错误的数据分析结果,这清楚地说明了其中的风险。由于「Think」按钮只能让较小的 Luna 推理更长时间,而不会切换到更强大的模型,因此免费用户将彻底失去使用 OpenAI 最强推理能力的机会。
订阅 THE DECODER,即可享受无广告阅读、每周 AI Newsletter、每年六期独家前沿报告「AI Radar」、完整历史文章访问权限,以及评论区访问权限。