FrontierMath 两年被刷穿:新 GPT 满分通过 Tier 4,开放难题已解 9/49
Afinetheorem · x · 2026-10-03
Afinetheorem 指出,数学家对 AI 的质疑性表态放到两年后看已令人震惊:当时还被认为极难的 FrontierMath Tier 3 已被饱和,更难的 Tier 4 被新 GPT 100% 解出,而最难档的「Open Problems」也已解出 49 题中的 9 题。
作者补充:瓶颈仍存在且很重要,但按这个速度(哪怕打一折)推演到生物学、制药、建筑、绿色能源、教育等领域,「不去实现它将是人类历史上最大的反进步失误」。
所属事件:FrontierMath 两年被刷穿 AI 数学能力再超预期(2 条相关)→
「模型」频道最新
- OpenAI 模型命名有多乱:从 GPT-4o 到 GPT-6.1 Sol 的吐槽 — Angaisb_ · 2026-10-03
- Gemini 意外暴露思维链,推理过程充满拟人化表述 — Electronic_Hunter_82 · 2026-10-03
- Ultra 订阅实测:Astra Ultra 用量消耗远比预期省 — jeppa35 · 2026-10-03
- Google Antigravity 出现 Ultra 订阅专属新内容 — opmgyhx · 2026-10-03
- 开发者实测:GPT 6.1 Sol 修 bug 远逊 Opus 5.5 — vista8 · 2026-10-03
- 用上 Opus 5.5 之后的生活是什么感觉?AI 圈热传梗图 — StewartalsopIII · 2026-10-03