曝GPT-5.6开启特定API设置后,ARC-AGI-3得分飙升3倍

sandersted · x · 2026-07-30

推文讨论了 GPT-5.6 在 ARC-AGI-3 基准测试中的表现。默认情况下该模型得分极低,但一旦开启 ChatGPT 和 Codex 内部使用的两个特定 API 设置,其在公共测试集上的得分会飙升约 3 倍,且 token 效率提升约 6 倍。

这表明模型的实际性能不仅取决于模型本身,还高度依赖于产品层面的工程封装与参数设置。

所属事件:GPT-5.6开启两项API设置后ARC-AGI-3得分飙升3倍(15 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →