作者精准预测 FrontierMath 得分,专家小组低估

peterwildeford · x · 2026-08-29

Peter Wildeford 分享其在 AI 能力预测上的表现优于专家组。针对“2025 年底 AI 在 FrontierMath 上的最高准确率”一题,作者预测 38%,而专家、超级预测者和公众的平均预测分别为 31%、30% 和 27%,实际结果为 40.7%。该预测源自新成立的纵向专家 AI 面板 (LEAP)。

所属事件:LEAP报告出炉:个体预测AI数学能力优于专家组(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →