模型预测实验结果能力大增,按趋势 2030 年 10 月可弥合 90% 差距
SaxenaNayan · x · 2026-10-07
Periodic Labs 的独立测试显示,给模型一个实验的描述和此前运行结果,让其预测实验得分:在 1,173 个实验上,模型表现自 GPT-4 Turbo 以来显著提升,最好的模型已能弥合朴素基线与不可约误差之间一半以上的差距。若趋势持续,到 2030 年 10 月将弥合 90% 的差距。作者补充:期间没有发明新方法/新模型,纯粹是能力自然提升。
所属事件:Periodic Labs:AI 预测实验能力激增(2 条相关)→
「模型」频道最新
- vLLM 首日支持 EmbeddingGemma 2:统一图文音视频的嵌入空间 — AccBalanced · 2026-10-07
- 谷歌发布 EmbeddingGemma 2:740M 参数首个原生多模态开源嵌入模型 — minchoi · 2026-10-07
- RedNote 被指拥有低调但实力雄厚的 AI 实验室 — teortaxesTex · 2026-10-07
- OpenAI 简化 API 限流门槛:五档并三档,500 美元即达最高级 — OpenAIDevs · 2026-10-07
- 用户吐槽 GPT-6.1 Sol 变慢变差:OpenAI 在 sandbagging? — rickasaurus · 2026-10-07
- 动态基准 SciConBench:AI 合成医学结论 61–90% 含事实错误 — manoelribeiro · 2026-10-07