CAIS 采纳建议改用 max 推理档重测全模型,GPT-6 表现稳健

polynoamial · x · 2026-09-24

在研究者建议后,CAIS/Scale AI 回应称已按建议将主榜结果更新为所有模型统一使用 "max" 推理档位重跑,并附上新结果链接,称 "GPT-6 似乎表现稳健"。此前有评论指出 "high" 档在不同模型间差异过大,且 "max" 档同样存在可比性问题。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →