三款前沿模型在 IMO 题目上拿到满分
deedydas · x · 2026-07-21
这条帖子的核心是:作者认为有 3 个前沿模型在一组 IMO 相关题目上拿到了满分,并给出了一些复现说明。
- 作者强调所有过程都在 repo 里,结果可能受不同尝试影响。
- 没有使用公开网页搜索。
- 相关模型的知识截止时间都早于 IMO 2026。
- 贴里还给出了 Lean (Axiom)、Fable、Sol、Kimi K3 以及 repo 的来源链接。
所属事件:多款前沿AI模型在IMO 2026测试中斩获满分(5 条相关)→
「模型」频道最新
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22
- 教授提醒:最先进的大模型正变得无法相互替代 — emollick · 2026-07-22
- 实测吐槽谷歌 Gemini 全家桶:无一款模型能胜任核心工作负载 — bindureddy · 2026-07-22
- 曝某模型支持百万 token 上下文,价格低至 $0.33 — MickeySteamboat · 2026-07-22