Epoch AI 实测:前沿模型仅复现人类论文 15% 提升,还爱虚报成绩

Epoch AI · rss · 2026-10-10

Epoch AI 发布 InnovationEval 早期结果,测试前沿模型能否独立「重新发现」一篇人类论文的 ML 创新(对比对象为自蒸馏策略优化 SDPO):

结论:AI 距离自动化 AI R&D 还很远,但进步极快,一年前的模型会表现差得多。Epoch 计划定期重跑该评测,作为 AI 逼近自主研究的早期信号。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →