GPT-5.6 推理 token 仍偏多

bdsqlsz · x · 2026-07-10

帖子作者做了一个对比测试,认为 Luna 约等于 GPT-5.5 mini,Terra 约等于 GPT-5.5 medium,Sol 表现最好,甚至低级别的 Sol 还优于最高级别的 Terra。

引用内容补充说,GPT-5.6 sol 虽然“更聪明”,但推理 token 过多的问题仍然存在:未做修改时会消耗 518n-2 的推理 token,即使答案正确也会发生;作者修正后,推理 token 更少,且 5/5 全对。

所属事件:GPT-5.6 发布引发性能与成本热议(10 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →