OpenAI 称 GPT-5.6 Sol 实现自我优化,推理成本降 20%
OpenAI 宣布在部署 GPT-5.6 (Sol) 模型后,利用该模型实现了对自身推理栈的自我优化,达成了前沿智能与运行效率的融合。官方数据显示,此次优化使服务成本大幅降低 20%,Token 生成效率提升 15% 以上。这标志着大模型已具备优化底层基础设施以降低高昂推理成本的能力,值得行业关注。
已确认
- 模型与部署:OpenAI 已部署 GPT-5.6 Sol 模型,并在 Codex 环境中进行了运行与优化测试。
- 服务成本降低:GPT-5.6 Sol 通过改进生产环境的 GPU 内核(重写底层代码),成功使端到端服务成本降低了 20%。
- 生成效率提升:通过改进推测性解码(并协助优化用于加速生成的小型模型),Token 生成效率提升了 15% 以上。
为什么重要
- AI 自我优化:此次优化并非单纯的人工调优,而是 GPT-5.6 Sol 模型直接参与了自身运行效率的提升。这表明先进的 AI 模型不仅能执行复杂任务,还能作为优化工具,直接解决大模型推理成本高昂的行业痛点,为提升商业化和运行效率提供了新路径。
2026-07-30 ~ 2026-07-30 · 6 条相关
一手来源
- OpenAI 称 GPT-5.6 Sol 实现自我优化:服务成本降 20% — OpenAI ·
- AI 重写 GPU 内核,OpenAI 推理成本大降 20% — nickbaumann_ ·
- 【源头】OpenAI 称 GPT-5.6 Sol 实现自我优化:服务成本降 20% — OpenAI · 2026-07-30
- OpenAI:GPT-5.6实现前沿智能与效率的融合 — Outside-Iron-8242 · 2026-07-30
- 【源头】AI 重写 GPU 内核,OpenAI 推理成本大降 20% — nickbaumann_ · 2026-07-30
另有 3 条近重复转述:Justin_Halford_ · soumitrashukla9 · bookwormengr