模型 / 官方
Luna 降幅达 80%,OpenAI 加速推动企业级 AI 规模化部署
OpenAI 宣布对 GPT-5.6 系列模型进行大幅降价:最快、最经济的 Luna 模型价格下调 80%,面向日常工作的均衡型 Terra 模型价格下调 20%。与此同时,API 端新增 Fast 模式,取代原有的优先处理选项,GPT-5.6 Sol 在 Fast 模式下速度最高可达标准处理的 2.5 倍,价格为标准模式的两倍,智能水平不变。此次降价源于 OpenAI 在模型架构、推理系统和智能体调度层面的系统性效率提升,其中 GPT-5.6 Sol 还参与了自身推理内核的优化工作,帮助将模型服务端到端成本降低 20%、Token 生成效率提升逾 15%。Replit、Notion、Ramp、Blitzy、Cognition、Dust 等企业已在生产环境中验证了 Luna 的成本与速度优势,部分场景成本降幅高达 87%。
OpenAI 于 2026 年 7 月 30 日宣布 GPT-5.6 系列模型的全面价格调整。其中,定位为最快、最经济型的 Luna 模型价格下调幅度高达 80%,面向日常办公场景的均衡型 Terra 模型价格下调 20%。新价格同步适用于 Codex 和 ChatGPT Work 付费订阅中的用量计算,企业用户无需额外操作即可享受降价红利。OpenAI 表示,此举旨在让更多企业以更低成本运行高吞吐量的 AI 工作流。
在 API 层面,OpenAI 同步推出 Fast 模式,正式取代此前的优先处理(Priority Processing)选项。针对 GPT-5.6 Sol,Fast 模式可提供最高 2.5 倍于标准处理的响应速度,价格为标准模式的两倍,且不影响模型智能水平。该模式向下兼容,原先标记为 priority 的请求将自动切换至 Fast 模式,开发者无需修改现有代码。
此次降价的底层支撑来自 OpenAI 在多个技术层面的协同优化。在模型侧,GPT-5.6 采用更直接的任务路径;在推理系统侧,优化后的生产软件显著提升了 Token 生成效率;在智能体调度侧,更智能的上下文管理减少了重复计算。值得关注的是,GPT-5.6 Sol 本身也参与了这一优化过程——它在人工监督下自主重写并优化了生产推理内核,设计并运行了数百项实验,最终将模型服务端到端成本降低 20%,Token 生成效率提升超过 15%。
多家头部企业已在生产环境中验证了 GPT-5.6 Luna 的实际效果。Replit 总裁 Michele Catasta 表示,Luna 是他们见过的最接近「智能成本趋近于零」的模型,解锁了此前预计很久才能实现的应用场景。Blitzy 联合创始人 Sid Pardeshi 则披露,Luna 在数千次生产调用中处理的上下文量是原来的 2.2 倍,输出 Token 减少 85%,成本较 GPT-5.4 mini 降低 87%。Dust 联合创始人 Stanislas Polu 也指出,相同智能体任务下,Luna 比此前默认模型快 40%、便宜 40%。
OpenAI 建议企业根据工作流的不同阶段灵活搭配模型,以实现最优性价比。例如,在编程工作流中,可以用 Sol 处理需要高度推理的规划环节,再用 Luna 执行已明确定义的代码实现、测试编写与结果评估等步骤。这种分层调度策略让企业能够在每个环节匹配恰当的智能水平,同时将整体成本控制在合理范围内。GPT-5.6 系列的推出,大幅扩展了企业在成本、速度与智能水平之间的调优空间。
从更宏观的视角来看,此次降价是 OpenAI 「让 AGI 惠及全人类」使命的具体落地。随着模型效率的持续提升与基础设施的规模化扩张,OpenAI 正在构建一个正向飞轮:模型越强,自我优化能力越强,效率提升越快,价格下降空间越大。OpenAI 表示,这一反馈循环将持续加速,未来还将有更多效率成果以降价或性能提升的形式传递给用户。
要点
- GPT-5.6 Luna 价格下调 80%,Terra 下调 20%,新价格同步适用于 Codex 和 ChatGPT Work 订阅用量计算。
- API 新增 Fast 模式取代优先处理选项,GPT-5.6 Sol 在 Fast 模式下速度最高提升 2.5 倍,向下兼容现有 priority 标记请求。
- GPT-5.6 Sol 参与了自身推理内核优化,将模型服务端到端成本降低 20%,Token 生成效率提升超 15%,形成模型自我优化的正向飞轮。
- 多家企业实测显示 Luna 成本降幅显著,Blitzy 报告成本较 GPT-5.4 mini 降低 87%,Dust 报告速度与成本均提升 40%。
- OpenAI 推荐企业按工作流阶段分层调用不同模型,在规划、执行、测试等环节匹配最优性价比的模型组合。
原始标题:Advancing the price-performance frontier with GPT-5.6
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。