Fable 5 在 GameDevBench 上达 67.3%,仅次于 GPT-5.6 Sol
scaling01 · x · 2026-07-24
Fable 5 在 GameDevBench 上拿到 67.3%,只输给 GPT-5.6 Sol
配图展示的基准结果显示,Fable 5 目前是 GameDevBench 上的最强模型之一,任务成功率达到 67.3%。
图里同时给出几个关键信息:
- 它只落后于 GPT-5.6 Sol
- 高于多个 GPT-5.6 Sol 变体以及 Claude Opus 4-8
- 作者还强调,半年前模型甚至还过不了 50%,进步非常快
「编程与Agent」频道最新
- Warp 六个非工程团队全用 Linear 和 Claude Code 工程化运作 — mon__lim · 2026-09-11
- 从聊天到 Agent,推理延迟正在成为生产级瓶颈 — Euphoric_Sea632 · 2026-09-11
- Anthropic 研究员:99% 工程师已跑 300+ 自改进 agent 群 — AlishaOutridge · 2026-09-11
- Gergely Orosz 观察:AI Agent 提速十倍交付,却带来一堆小退化 — ducha_aiki · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11