Anthropic 首个帕累托最优模型:Fable 5.1 赢下编程测试
PawelHuryn · x · 2026-09-02
Anthropic 模型 Fable 5.1 在 Bug Hunt Bench 测试中表现优异,成为首个达到帕累托前沿的模型。
测试结果:
- Fable 5.1 (max): 43/105 bugs fixed
- GPT-5.6 Sol (max): 42/105 bugs fixed
- Grok 4.6 (xhigh): 27/105 bugs fixed
性能对比:
- 速度比 GPT-5.6 Sol 快 2.24 倍
- 成本比 Fable 5 低 26%
评论指出,虽然 Fable 5 让人感觉良好,但之前并非最佳编码模型,此次表现令人意外。
所属事件:Anthropic Fable 5.1 登顶 Bug Hunt Bench,超 GPT-5.6(4 条相关)→
「编程与Agent」频道最新
- Vicki Boykis:在 AI 时代我们需要删掉更多代码 — vboykis · 2026-09-02
- Claude Fable 5.1 重现论文并拓展研究,Mythos 自写内核提速 — BenBlaiszik · 2026-09-02
- AI 架构师日报:Agent 团队与上下文缓存实践 — rseroter · 2026-09-02
- Cloudflare Agents 支持 OpenTelemetry 追踪,可直连 Braintrust 评估 — ritakozlov · 2026-09-02
- 用户试用 Octo.nvim:功能齐全但交互手感欠佳 — 4310sy · 2026-09-02
- Fable 5.1 删除代码测试飙至 3.3 万行 — Sauers_ · 2026-09-02