Claude Fable、GPT-5.6 Sol、Kimi K3 都拿下 IMO 2026 满分

deedydas · x · 2026-07-21

作者拿 **Claude Fable、GPT-5.6 Sol、Kimi K3 和 Axiom** 跑了 **2026 IMO**,结果四个都拿到 **42/42** 满分。 - **Claude Fable 5** 只用 **1 次尝试** 就解出,且总耗时最快,约 **2.5 小时**。 - **GPT-5.6 Sol** 只多了 **1 次尝试**,但在这组里最省钱。 - **Kimi K3** 也解出来了,但重试更多、token 消耗也明显更高。 - **Axiom Math** 则把证明正式落在了 **Lean** 里。 配图里的统计还显示,**P3 和 P6** 是最难的两题,按尝试次数和 token 都最重。作者的结论是:**AI 的前沿已经明显越过 IMO 数学**。

所属事件:多款前沿AI模型在IMO 2026测试中斩获满分(5 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →