GPT-6.1 sol 纯推理反超对手:HLE-Diamond 拿 67.4%,仅用 4k token

haider1 · x · 2026-09-30

X 用户 haider1 分享了据称是 GPT-6.1 sol 在 HLE-Diamond 基准上的成绩(未经官方证实):

若属实,说明该模型在推理效率上有明显优势——同等或更高准确率下 token 消耗只有竞品的四分之一到二分之一。数据来自第三方账号,尚待官方确认。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →