据文中消息,OpenAI 用 GPT-5.6 Sol 统一 Plus 与 Pro 的即时和深度推理模式,并通过滑块调节推理强度;免费层则使用 Luna。内部评测宣称事实错误较上一代即时模型减少 68%。
OpenAI 为 Plus 和 Pro 用户将 ChatGPT 的推理能力统一到 GPT-5.6 Sol,免费版则使用 Luna。内部评估显示,事实性错误减少了 68%。
据 @rohanpaul_ai 称,OpenAI 已用 GPT-5.6 Sol 取代原本彼此分离的 Instant/Thinking 模型阵容,面向 ChatGPT Plus 和 Pro 用户提供服务。这项调整统一了不同推理级别下的行为,回应了用户长期以来的一项不满。
OpenAI 已整合其 ChatGPT 模型架构。据 @rohanpaul_ai 称,GPT-5.6 Sol 现在同时为 Plus 和 Pro 订阅用户的 Instant 与 Thinking 模式提供支持。此前,从 Instant 切换到更高的推理投入程度时,往往会让人感觉像是换了一个模型,因为模型的语气和行为也会随之变化。新的滑块可以调节 ChatGPT 在回答中投入多少思考,同时底层始终使用 GPT-5.6 Sol。
Free 和 Go 用户将默认使用 GPT-5.6 Luna,可以进行不限次数的文本聊天,并能通过 Think 按钮处理难度更高的问题。这延续了 OpenAI 自 GPT-5 发布以来采用的分层策略,但关键变化在于,不同推理级别之间的行为变得更加一致。
OpenAI 声称,其针对金融、医学和法律领域开展的内部评估发现,与 GPT-5.5 Instant 相比,事实性错误的出现频率降低了 68%。该公司并未披露评估的样本规模或方法,因此应谨慎看待这一数字。
这项调整解决了一项已知的 UX 摩擦:用户切换推理投入程度时,经常会发现模型的“性格”也发生变化,导致输出给人一种不可靠的感觉。通过在不同投入级别下始终使用 Sol,OpenAI 押注的是:与单纯提升能力相比,一致性更有助于建立信任。此举也简化了公司的模型路由,有望降低推理过程的复杂度。
对于 Plus 和 Pro 订阅用户,实际变化看似细微,却十分重要:现在,无论是快速查询还是深度推理,都由同一个模型处理,因此语气和风格能够保持稳定。免费用户则可以使用能力更强的默认模型 Luna,并通过 Think 按钮手动启用深入思考,从而缩小不同订阅层级之间的差距。如果 68% 的错误率降幅能在第三方基准测试中复现,那么相较于 GPT-5.5 Instant,这将意味着可靠性取得了显著提升。
请留意 OpenAI 接下来发布的开发者文档更新,以确认 GPT-5.6 Sol 是否会开放 API,以及具体定价。同时,也应关注 SWE-Bench、GPQA 等第三方基准测试结果,以验证事实性错误减少 68% 的说法。如果 Luna 出现在 API 日志中,预计它还会进一步推广到企业级订阅层级。
最初发布于 gentic.news。
如需采取进一步措施,你可以考虑屏蔽此人和/或举报滥用行为。