自建 GoBench:GPT-6 Astra 下棋达 2568 Elo 领跑

Roland31415 · reddit · 2026-09-17

Reddit 用户 Roland31415 发布了自建的 GoBench 基准,用围棋对局来测量 LLM 的通用推理能力。结果:GPT-6 Astra max 达 2568 Elo,明显高于 Opus 5 high(2076)和 Sol max(1929);若开启无网络编码模式,Codex 搭配 Astra 更达 3563 Elo,远超 Codex+Sol 的 2656。排行榜已公开发布。

所属事件:GoBench发布:用围棋测LLM通用推理(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →