允许批量走子后,GPT-6 把 30 亿 token 压到 3.5 亿

patience_cave · x · 2026-09-07

MazeBench 线程细节:为省 token,评测允许 GPT-6 Astra 每回合批量提交走法而非一步一步走,模型于是稳定地提前规划 10-20 步,把原本 30 亿 token 的消耗压缩到 3.5 亿。在华容道(Klotski)谜题上,批量模式的 Astra 成本便宜 3 倍,但思考时间延长 60%。

所属事件:GPT-6 Astra 创 MazeBench 最高分但仍卡在 3D 空间推理(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →