Anthropic Fable 5.1 登顶 Bug Hunt Bench,超 GPT-5.6
在针对 2 个真实代码库、105 个植入 Bug 的 Bug Hunt Bench 测试中,Anthropic 的 Fable 5.1 修复了 43 个 Bug,超越 GPT-5.6 Sol 的 42 个和 Grok 4.6 的 27 个,登顶排行榜,并成为首个达到帕累托前沿的模型,即同时做到更快、更便宜且性能更强。该基准还公开了详细数据与收据以供验证前沿编程模型的真实表现。
2026-09-02 ~ 2026-09-02 · 4 条相关
- Fable 5.1 夺冠 Bug Hunt Bench,表现超 GPT-5.6 — PawelHuryn · 2026-09-02
- Fable 5.1 登顶 Bug Hunt 榜,超 GPT-5.6 且更快更便宜 — PawelHuryn · 2026-09-02
- Anthropic 首个帕累托最优模型:Fable 5.1 赢下编程测试 — PawelHuryn · 2026-09-02
- Bug Hunt Bench 排行榜:Fable 5.1 数据细节与对比 — PawelHuryn · 2026-09-02