GPT-6.1 Sol 在 MazeBench 仅得 9%,险胜 Claude Opus 5.5

patience_cave · x · 2026-10-02

MazeBench 测试结果显示,GPT-6.1 Sol 仅得 9%,略高于 Opus 5.5。与上一代 GPT-6 Astra 相比,Sol 保留了解谜能力但成本降至其 10%。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →