3 个公开模型据称花 10–50 美元解出 IMO,去年最佳仅 35/42
deedydas · x · 2026-07-21
- 发帖者称:**IMO(国际数学奥赛)第一次被“彻底解出”了**。 - 他对比说,去年最强的是一个**未发布的 Gemini Deep Think** 和一个 **OpenAI 实验模型**,都拿到 **35/42**。 - 今年则有 **3 个公开可用的模型** 做到 **满分**,其中还包括一个**即将开源权重**的模型。 - 更夸张的是,完成这件事的成本据称只有 **10–50 美元**。
所属事件:多款前沿AI模型在IMO 2026测试中斩获满分(5 条相关)→
「模型」频道最新
- 财报方向预测基准显示前沿模型继续领先开源模型 — dougclinton · 2026-07-21
- Holo-3.1-35B-A3B-NVFP4 连续数周领跑 Spark Arena 2 节点榜 — Porespellar · 2026-07-21
- GPT-5.6 Sol 被指比 Opus 4.8 更会温和反驳 — JeremyNguyenPhD · 2026-07-21
- 一次编程会话里,Claude Opus 4.8 Fast 被吐槽太贵 — immersive-matthew · 2026-07-21
- 微软研究院把病理模型做轻量,仍保留 GigaPath 97% 性能 — iScienceLuvr · 2026-07-21
- 中国开源权重模型正冲击 OpenAI 与 Anthropic 经济叙事 — kimmonismus · 2026-07-21