Sonnet 5.5 对阵 GPT 6.1 Sol 下国际象棋:推理 tokens 差 18 倍

adigrazia80 · reddit · 2026-10-04

一位 Reddit 用户用 MCP 把 Sonnet 5.5(Claude Desktop)和 GPT 6.1 Sol(Codex)接进一个本地国际象棋应用,让两者各用一局对话下满一整盘棋,无引擎、无合法着法提示,共下两局目前 1-1。

关键数据(双方均为 Medium 推理档):

作者还对比了订阅额度消耗:Claude $20/月计划的五小时额度从 23% 涨到 56%,而 Codex($200/月)周额度始终显示 5%。对局中 Sonnet 曾称升兵"势不可挡"却在几步后承认漏了 Bf3 防守,还有一次被服务器拒绝后自我纠正;Codex 也误判过一次过路兵。作者强调两局样本不能推断棋力差异,计划换先后手重赛。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →