AI资讯 / 产业

产业 / 媒体

OpenAI 升级 GPT-5.6 Sol 并将免费用户限制在最弱模型

The Decoder

OpenAI 近日对 ChatGPT 进行了一轮差异化更新:Plus 和 Pro 付费用户将获得经过优化的 GPT-5.6 Sol,该模型在回答简单问题时更加简洁直接,面对复杂任务则提供结构清晰的详细回应,同时新增推理深度滑块,允许用户在五个档位之间调节模型的思考力度。与此同时,免费用户将在本周迎来默认模型切换——从原有版本换为更小的 GPT-5.6 Luna,并在下周获得无限文字对话权限及一个「思考」按钮。然而,该按钮仅让 Luna 延长推理时间,并不会切换至更强大的模型,这意味着免费用户实际上失去了访问 OpenAI 最强推理能力的渠道。OpenAI 内部评估显示,与 GPT-5.5 Instant 相比,两款新模型的事实错误率均有显著下降,但这一数据尚未经过独立验证。

OpenAI 表示,GPT-5.6 Sol 经过本次更新后,回答风格更加精炼,减少了不必要的细节堆砌和过度格式化。对于简单问题,模型会给出直接答案并附带适量背景信息;对于复杂任务,则提供更完整的分析,同时确保核心建议易于识别。此次更新仅适用于 ChatGPT 主产品,ChatGPT Work 和 Codex 中的 GPT-5.6 Sol 版本保持不变。

在事实准确性方面,OpenAI 援引内部评估数据称,使用金融、医疗和法律领域提示词进行测试时,GPT-5.6 Luna 的含错误回答比例较 GPT-5.5 Instant 下降约 62%,GPT-5.6 Sol 则下降约 68%。不过,这些数字目前尚未经过第三方独立核实,外界对其参考价值仍持保留态度。

付费用户此次获得的推理深度滑块此前已在 ChatGPT Work 中上线,现扩展至网页、移动端和桌面客户端。滑块共分五档,低档适合日常问答,高档则面向规划、研究和编程等需要深度思考的场景。OpenAI 希望借此让快速回答与深度推理在同一模型内无缝衔接,而非让用户感觉在使用两个风格迥异的工具。

然而,增加更多操控选项未必能真正改善用户体验。此前 OpenAI 推出模型切换器时,用户的使用率相当低迷,而选择合适的模型对任务质量的影响,远比在五个推理档位之间微调更为关键。如何让普通用户真正理解并善用这些控制选项,仍是一个悬而未决的问题。

对于免费用户而言,GPT-5.6 Luna 将成为新的默认模型,无限文字对话和「思考」按钮将于下周跟进上线,但文件上传、图像生成等工具的使用限制依然保留。值得注意的是,「思考」按钮只是让 Luna 在原有基础上延长推理时间,并不会调用更强大的模型。结合此前曾有案例显示,较小的 Instant 模型在数据分析任务中给出了与大型推理模型完全相反的错误结论,免费用户在处理高要求任务时面临的风险不容忽视。

要点

  • GPT-5.6 Sol 针对付费用户优化了回答简洁度与事实准确性,内部测试显示错误率较上一代下降约 68%,但数据未经独立验证
  • 新增推理深度滑块让付费用户可在五个档位间调节模型思考力度,覆盖网页、移动端和桌面平台
  • 免费用户将默认切换至更小的 GPT-5.6 Luna,虽获无限文字对话,但「思考」按钮不会调用更强模型,实际上失去了最强推理能力的访问权
  • 更多操控选项不等于更好体验,用户对模型切换器的低使用率表明,界面复杂度与实际效用之间存在落差
查看原始来源

原始标题:OpenAI improves GPT-5.6 Sol in ChatGPT and restricts free users to its weakest model

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。