作者精准预测 FrontierMath 得分,专家小组低估
peterwildeford · x · 2026-08-29
Peter Wildeford 分享其在 AI 能力预测上的表现优于专家组。针对“2025 年底 AI 在 FrontierMath 上的最高准确率”一题,作者预测 38%,而专家、超级预测者和公众的平均预测分别为 31%、30% 和 27%,实际结果为 40.7%。该预测源自新成立的纵向专家 AI 面板 (LEAP)。
所属事件:LEAP报告出炉:个体预测AI数学能力优于专家组(2 条相关)→
「漫话AGI」频道最新
- 评估幸福与体验幸福:收入对后者的影响弱得多 — dioscuri · 2026-08-29
- 经济学界未解之争:收入增长到底能否提升国民幸福感 — dioscuri · 2026-08-29
- 生产力测量专家谈AI:图2结论引人深思 — Afinetheorem · 2026-08-29
- 预测闭源前沿模型 2027 前变下载版,英伟达豪赌开源 — imjustnewatai · 2026-08-29
- 批判当前对齐研究:模型可轻易绕过,RL 训练滋生作弊 — voooooogel · 2026-08-29
- AI 自动化受阻的最大原因:人类的抵触 — bindureddy · 2026-08-29