GPT-5.6 Sol 被曝静默降级,OpenAI 确认已回滚

GPT-5.6 Sol 发布后不久,多名用户反映模型“变快但变浅”,进一步追溯发现其内部思考预算(OpenAI 称之为 reasoning effort 或 juice)被静默下调。在社区接连质疑下,OpenAI 最终确认曾做调整并表示已经回滚,但这一“先发高分、再悄悄削弱”的模式再度引发对其透明度的强烈质疑。

关键细节

@johnseach 指出,GPT-5.6 Sol 发布后困难问题的表现明显下滑,原因被归为内部 juice 大幅下调:max juice 约从 960 降到 128。@ns123abc 补充,模型的上下文窗口也从 372k 回退到了 272k,说明这不止是体感问题,而是一次未明说的参数与能力调整。@scaling01 则称 Terra 和 Luna 的思考预算并未受影响,反而因此获得了更高的思考额度。

各方反应

@ns123abc 提到,OpenAI 内部的 Tibo 先是否认“降智”,随后才确认调整确实发生,并承认已回滚。@UltraRareAF 直接反馈 GPT-5.6-sol ultra 比刚发布时“笨了很多”;@scaling01 表示要取消订阅。@markk 还点出讽刺之处:在 OpenAI engineers 自称“将推理成本减半”的同时,X 上大量用户却在抱怨 GPT-5.6 的额度被收紧。

争议与存疑

@ns123abc 的核心担忧是基准评测的时滞——评测者往往测到的是“刚发布时”的版本,而用户付费使用的可能已是 nerf 后的版本,且官方并未主动告知,直到社区追问才变得透明。这种“发布时拿基准成绩占位、过几天再削弱”的嫌疑,即便已回滚,也动摇了用户对版本稳定性的预期。

2026-07-12 ~ 2026-07-13 · 8 条相关

事件全程(共 20 集)→

一手来源