ARC-AGI 揭秘:推理 Token 越多越容易跑偏,GPT-5.6 Max 反而更省钱

GregKamradt · x · 2026-08-08

Greg Kamradt 引用了 ARC Prize 官方对推理模型测试中“锯齿状”成本曲线的深度技术分析。研究发现,更高的推理性能往往伴随着更低的成本,这与直觉相悖。

官方解释称,处于最高推理模式(Max)的模型实际上比高推理模式消耗的 Token 更少。原因在于:

例如在 ARC-AGI-2 的一项任务中,High 模式耗费 9.8 万 Token 构建了复杂的错误理论,而 Max 模式仅用 7.6 万 Token 就得出了正确结论。这也印证了 DeepSeek 在该测试中展现出的极高性价比。

所属事件:DeepSeek V4 Flash登顶ARC-AGI性价比前沿(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →