GPT-5.6 跑分翻车?开启特定 API 设置后效率暴增

sandersted · x · 2026-07-30

开发者实测发现,GPT-5.6 在 ARC-AGI-3 基准测试中初始表现不佳。但在开启 ChatGPT 和 Codex 内部使用的两个特定 API 设置后,其公共测试集得分提升了约 3 倍,且 token 使用效率提高了约 6 倍。这表明模型的实际性能表现不仅取决于模型本身,更取决于外围产品工程与参数配置。

所属事件:GPT-5.6开启特定API设置后ARC-AGI-3得分飙升3倍(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →