自主研究排行榜:Fable 5 第一,Kimi K3 紧随其后

eliebakouch · x · 2026-08-16

Prime Intellect 公布了 NanoGPT 优化任务的自主 Agent 排行榜。在参与测试的 18 个模型中,Fable 5 以 2,726 步的成绩位列第一,缩小了 81.7% 的性能差距;Opus 5 和 Kimi K3 分别占据第二和第三名,均缩小了超过 50% 的差距。GPT-5.6 系列模型表现中等,排名靠后。部分模型如 Qwen 3.8 Max 和 DeepSeek V4 Pro 的测试仍在运行中。

所属事件:最大规模 18 模型 AI 自主研究实测,Fable 5 居首(7 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →