
作者 | 江宇
编辑 | 李水青
智东西 7 月 31 日报道,今日,OpenAI 宣布下调 GPT-5.6 系列模型 API 价格。其中,GPT-5.6 Luna 价格下调 80%,GPT-5.6 Terra 价格下调 20%,GPT-5.6 Sol 则新增Fast 模式,在保持模型能力不变的情况下,最高可实现2.5 倍推理速度。
与此同时,OpenAI 公布了一张基于 Artificial Analysis Intelligence Index v4.1 的价格 - 性能分布图。

相比之下,Claude Opus 5、Gemini 3.6 Flash、GLM-5.2 Max 等模型拥有近乎相近的智能指数,但完成单项任务的成本更高;DeepSeek V4 Pro 则位于更靠左的位置,单次任务成本低于多数前沿模型,但智能指数约为 44 分。OpenAI 借此强调,GPT-5.6 Luna 能够在成本和智能之间提供更优的平衡。
OpenAI 联合创始人兼 CEO Sam Altman 随后发文称,希望 "在每一个模型层级,都提供最好的价格与智能比(price/intelligence tradeoff)"。




一、Luna 降价 80%,Terra 降 20%,Sol 新增 Fast 模式
此次调整覆盖 GPT-5.6 全系列模型。
其中,降幅最大的是 GPT-5.6 Luna。其 API 价格从即日起下调 80%,输入价格降至每百万 Token 0.2 美元(约合人民币 1.35 元),输出价格降至每百万 Token 1.2 美元(约合人民币 8.11 元)。
定位均衡模型的GPT-5.6 Terra 价格则下调 20%,调整后输入价格为每百万 Token 2 美元(约合人民币 13.51 元),输出价格为 12 美元(约合人民币 81.06 元)。
旗舰模型 GPT-5.6 Sol 价格保持不变,但 API 新增 Fast 模式。
Fast 模式能够在模型能力保持一致的情况下,实现最高 2.5 倍于标准模式的推理速度,价格则为标准模式的两倍。此前使用 Priority Processing 的 API 请求,也将自动迁移至 Fast 模式。
与此同时,ChatGPT Work 和 Codex 中的额度计算方式也同步调整。由于 Luna 和 Terra 价格下降,用户在这两项产品中的额度消耗也将减少。Free 和 Go 用户可使用 Terra;Plus、Pro、Business 和 Enterprise 用户则可选择 Terra 和 Luna。
二、GPT-5.6 把自己优化了
就在前一天,OpenAI 披露,GPT-5.6 Sol 已经被用于优化自身推理系统。

在工程师主导下,GPT-5.6 Sol 能够自主重写生产环境 GPU Kernel、设计并执行数百项实验、监控训练过程,并在出现问题时主动介入。
最终,这一系列优化带来了两项成果:生产 GPU Kernel 优化使模型整体服务成本下降 20%;推测解码(Speculative Decoding)优化则让 Token 生成效率提升 15% 以上。
OpenAI 认为,这意味着模型已经能够帮助研发团队进一步优化模型本身,形成 " 模型越强、优化越快 " 的正向循环。
此次 Luna 和 Terra 降价,也被视为 OpenAI 将这部分效率提升直接反馈给开发者。
除了模型层面的优化,OpenAI 还提到,GPT-5.6 在推理系统、上下文管理以及 Agent 工作流等多个环节进行了效率提升,使模型能够以更少的计算资源完成更多工作。
三、开发者炸锅:有人喊 Anthropic 跟进,有人拿 Kimi K3 做起了对比
消息公布后,评论区依旧热闹。
有开发者称,自己的 OpenAI API 额度今天终于能 " 轻松一点了 "。






最近两天 OpenAI 连续释放出的信号显示,另一场关于 " 智能比 " 竞争正在同步展开。
一方面,GPT-5.6 已经开始帮助 OpenAI 优化自身推理效率;另一方面,这部分效率提升最终转化为了更低的模型价格和更快的响应速度。
当模型能力逐渐趋近,如何让同样的算力完成更多工作、让开发者花更少的钱获得更多智能,正在成为下一轮大模型竞争的重要方向。



