Sonnet 5.5 对阵 GPT 6.1 Sol 下国际象棋:推理 tokens 差 18 倍
adigrazia80 · reddit · 2026-10-04
一位 Reddit 用户用 MCP 把 Sonnet 5.5(Claude Desktop)和 GPT 6.1 Sol(Codex)接进一个本地国际象棋应用,让两者各用一局对话下满一整盘棋,无引擎、无合法着法提示,共下两局目前 1-1。
关键数据(双方均为 Medium 推理档):
- Sonnet 5.5:有效回合耗时 33m45s,输出 269,076 tokens(其中推理 224,770),累计输入 57.44M tokens,API 等价约 $16.21,1 次非法着法
- GPT 6.1 Sol:耗时 21m12s,输出 34,956 tokens(推理仅 12,128),输入 16.81M,约 $2.37,零非法着法
作者还对比了订阅额度消耗:Claude $20/月计划的五小时额度从 23% 涨到 56%,而 Codex($200/月)周额度始终显示 5%。对局中 Sonnet 曾称升兵"势不可挡"却在几步后承认漏了 Bf3 防守,还有一次被服务器拒绝后自我纠正;Codex 也误判过一次过路兵。作者强调两局样本不能推断棋力差异,计划换先后手重赛。
「Fun」频道最新
- AI 领域知名学者 Domingos 机场段子:去法兰克福谈「如何毁灭人类」 — pmddomingos · 2026-10-04
- Yacine 自曝把不存在的 Opus 5.5 拽出分布外强逼思考 — yacineMTB · 2026-10-04
- 笔记本开着 Claude Code 过夜起火,「烧 token」成真 — Miles_Brundage · 2026-10-04
- 「ChatGPT」申请访问你腹侧被盖区神经元:允许/不允许? — ZeroStateReflex · 2026-10-04
- 让 Grok、ChatGPT、Claude、Gemini、DeepSeek 画自己,画风对比走红 Reddit — Outrageous-Ad-9080 · 2026-10-04
- 让 ChatGPT 画「Tung Tung Tung Sahur 西班牙失散亲戚」,结果逗乐网友 — Automatic-Algae443 · 2026-10-04