有人把模型基准测试,玩成了菲尔兹奖和阿贝尔奖
beffjezos · x · 2026-07-23
把模型评测开了个玩笑:作者说,下一代 benchmark 套件应该看模型能拿多少 菲尔兹奖 或 阿贝尔奖。
这条本质上是在调侃 AI 圈对基准测试的执念,意思是:与其继续刷合成指标,不如直接看模型在真正数学天赋上的表现。
「Fun」频道最新
- 一张“数学专业身份反转”的梗图 — miniapeur · 2026-07-23
- 一张吐槽 Excel 把 10/5 变日期的梗图 — miniapeur · 2026-07-23
- 一张对比 vibe coding 与 vibe debugging 的梗图 — miniapeur · 2026-07-23
- 一个“有不清楚就采访我”的提示词被吹成原子弹 — lxfater · 2026-07-23
- “Slop Tsunami” 成了 AI 圈新梗 — wavefnx · 2026-07-23
- 有条梗说,AGI 得先成功撩到 Domhnall Gleeson — birchlse · 2026-07-23