自主研究排行榜:Fable 5 第一,Kimi K3 紧随其后
eliebakouch · x · 2026-08-16
Prime Intellect 公布了 NanoGPT 优化任务的自主 Agent 排行榜。在参与测试的 18 个模型中,Fable 5 以 2,726 步的成绩位列第一,缩小了 81.7% 的性能差距;Opus 5 和 Kimi K3 分别占据第二和第三名,均缩小了超过 50% 的差距。GPT-5.6 系列模型表现中等,排名靠后。部分模型如 Qwen 3.8 Max 和 DeepSeek V4 Pro 的测试仍在运行中。
所属事件:最大规模 18 模型 AI 自主研究实测,Fable 5 居首(7 条相关)→
「编程与Agent」频道最新
- 定制化开发工具常遇尴尬,传统工具组合仍具优势 — bigblueboo · 2026-08-16
- AI中间产物泛滥,网友提议给智能体加垃圾回收分拣机制 — dht · 2026-08-16
- DeepSeek Harness 48小时破10万星,增速超 OpenClaw — Hesamation · 2026-08-16
- 前端趋势:因 AI 辅助开发,纯 HTML 网站或复兴 — gethackteam · 2026-08-16
- Spawn Games 更新:可联动最喜欢的 Agent 一起玩游戏 — TAbrodi · 2026-08-16
- Agent 选型指南:Opus 擅长 3D,Sol 音频表现出色 — nptacek · 2026-08-16