【CNMO 科技消息】近日,OpenAI 宣布已将其最新 AI 模型 GPT-5.6 Sol 投入真实生产环境,用于优化 GPT-5.6 系列自身的推理基础设施。经过一系列自主优化操作,OpenAI 的推理服务部署成本大降 20%,Token 生成效率提升了 15% 以上。

ChatGPT
在内核优化方面,GPT-5.6 Sol 通过 Codex 工具,自主改写了生产环境中的 GPU 底层代码。它学习了 Triton 和 Gluon 两种开源编程语言,能识别模型中哪些计算可以提前做、哪些可以省略、哪些可以并行处理,并据此优化代码,让运行更高效。此外,该模型还能智能分析负载并自动调配算力资源。

据 CNMO 科技了解,该模型还改进了推测解码技术,即小模型预生成、大模型校验的并行工作机制。它自主设计并完成了数百组对照实验,在小模型规模、网络结构和功能模块等方面持续优化,最终使整体生成效率提升超过 15%。
在这些优化共同作用、最终在不改变模型核心权重、仍由人类工程师掌控最终决策权的前提下,OpenAI 实现了推理服务部署成本大降 20%。
整体来看,GPT-5.6 Sol 的自我优化已初步验证了一条可行路径:让 AI 来优化 AI 本身。随着这一机制的不断成熟,推理成本的下降和效率的提升有望进一步加速。
版权所有,未经许可不得转载


登录后才可以发布评论哦
打开小程序可以发布评论哦