陶哲轩曾称 FrontierMath 可抵御 AI 数年,Tier-4 已被刷爆
haider1 · x · 2026-10-06
作者回顾:2024 年 12 月,Terence Tao 和 Timothy Gowers 曾对 FrontierMath Tier 3 基准评价极高——陶哲轩认为它可能「抵御 AI 数年」,Gowers 称哪怕解开几道题也算「真正的突破」。不到两年后,连更高难度的 Tier-4 也已被前沿模型饱和,指数级进展快到连菲尔兹奖得主都被打脸。
「模型」频道最新
- Beam 首个模型开源:501B-A23B 文本 MoE,Apache 2.0 全栈放发 — brandondamos · 2026-10-06
- 开发者警告:Pangram AI 检测器不可靠,不应被当真使用 — jdjohnson · 2026-10-06
- Gemini 4 Argon 登顶 Text Arena,超第二名 Opus 4.6 达 20 分 — arena · 2026-10-06
- Arena CEO:花钱雇人做基准数据集的那一刻,评测就不再真实 — arena · 2026-10-06
- Reflection AI 首个开放权重模型正式发布 — nmasc_ · 2026-10-06
- OpenAI 在 Responses API 内置 compaction,被指或成厂商锁定手段 — pvncher · 2026-10-06