最大规模 18 模型 AI 自主研究实测,Fable 5 居首

Prime Intellect 于 8 月 16 日发布博客《Measuring Autonomous AI Research》及配套自主研究排行榜,公布迄今最大规模的 AI 自主研究实验:在 nanoGPT 优化任务上以 8xH200 沙箱完成 153 次自主运行、覆盖 18 个前沿模型,单次运行最长 8 天,完整结果与追踪数据全部开源。Fable 5 以 2,726 步位列第一,缩小 81.7% 的人类性能差距。该实验为衡量前沿模型的自主科研能力提供了可复现的公开基准。

已确认

尚未确认

为什么重要

2026-08-16 ~ 2026-08-16 · 6 条相关

一手来源