模型预测实验结果能力大增,按趋势 2030 年 10 月可弥合 90% 差距

SaxenaNayan · x · 2026-10-07

Periodic Labs 的独立测试显示,给模型一个实验的描述和此前运行结果,让其预测实验得分:在 1,173 个实验上,模型表现自 GPT-4 Turbo 以来显著提升,最好的模型已能弥合朴素基线与不可约误差之间一半以上的差距。若趋势持续,到 2030 年 10 月将弥合 90% 的差距。作者补充:期间没有发明新方法/新模型,纯粹是能力自然提升。

所属事件:Periodic Labs:AI 预测实验能力激增(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →