Claude Fable、GPT-5.6 Sol、Kimi K3 都拿下 IMO 2026 满分
deedydas · x · 2026-07-21
作者拿 **Claude Fable、GPT-5.6 Sol、Kimi K3 和 Axiom** 跑了 **2026 IMO**,结果四个都拿到 **42/42** 满分。 - **Claude Fable 5** 只用 **1 次尝试** 就解出,且总耗时最快,约 **2.5 小时**。 - **GPT-5.6 Sol** 只多了 **1 次尝试**,但在这组里最省钱。 - **Kimi K3** 也解出来了,但重试更多、token 消耗也明显更高。 - **Axiom Math** 则把证明正式落在了 **Lean** 里。 配图里的统计还显示,**P3 和 P6** 是最难的两题,按尝试次数和 token 都最重。作者的结论是:**AI 的前沿已经明显越过 IMO 数学**。
所属事件:多款前沿AI模型在IMO 2026测试中斩获满分(5 条相关)→
「模型」频道最新
- Claude 20x 用户称限额收紧,额度消耗更快 — MarcJSchmidt · 2026-07-21
- Cola 推出 July,又一个“仅次于 Fable”的模型 — oran_ge · 2026-07-21
- Kimi K3 在前端仪表盘任务上更强,成本约低 5 倍 — OwariDa · 2026-07-21
- 播客回顾:Anthropic 650 亿美元融资与 IPO 申请 — Last Week in AI · 2026-07-21
- 用户称 Claude 4.6 昨天明显变差,质疑模型会否随时间漂移 — Rahios · 2026-07-21
- Kimi K3 软件任务峰值 89.4%,Fable 5 稳定性略高 — FinanceYF5 · 2026-07-21