Fable 5 在 GameDevBench 上达 67.3%,仅次于 GPT-5.6 Sol
scaling01 · x · 2026-07-24
Fable 5 在 GameDevBench 上拿到 67.3%,只输给 GPT-5.6 Sol
配图展示的基准结果显示,Fable 5 目前是 GameDevBench 上的最强模型之一,任务成功率达到 67.3%。
图里同时给出几个关键信息:
- 它只落后于 GPT-5.6 Sol
- 高于多个 GPT-5.6 Sol 变体以及 Claude Opus 4-8
- 作者还强调,半年前模型甚至还过不了 50%,进步非常快
「编程与Agent」频道最新
- The Stack v3 升级为 114TB、5 万亿 tokens 的最大开源代码集 — JJitsev · 2026-07-24
- Cursor 推出编程请求模型路由器,称成本可降 60% — Arindam_1729 · 2026-07-24
- 观点:AI Agent 产品终将退化为底层代码库 — samgoodwin89 · 2026-07-24
- 工程负责人用 OpenLoomi 同步 GitHub、Linear 和 PR 审查 — Yuuyake · 2026-07-24
- Gemini CLI 串行化凭据写入,修复无限 OAuth 认证循环 — EngKMM · 2026-07-24
- 独立搜索让 Fable、Sol、Grok 和 Gemini 准确率都更高 — ycombinator · 2026-07-24