Fable 5.1 登顶 Bug Hunt 榜,超 GPT-5.6 且更快更便宜
PawelHuryn · x · 2026-09-02
在针对 2 个真实代码库、105 个植入 Bug 的测试中,Fable 5.1 修复了 43 个,超越了 GPT-5.6 Sol (42 个) 和 Grok 4.6 (27 个)。Fable 5.1 比 GPT-5.6 Sol 快 2.24 倍,且比上一代 Fable 5 便宜 26%。博主称 Fable 5 虽让人感觉良好,但并非最强编码模型,此次 5.1 版本的表现令人意外。
所属事件:Anthropic Fable 5.1 登顶 Bug Hunt Bench,超 GPT-5.6(4 条相关)→
「模型」频道最新
- 开发者实测:CritPt 评分体系存在缺陷,未随推理增加 — scaling01 · 2026-09-02
- MiniMax-M3 基准跑出 2274 tok/s,Cacheon 聚焦企业端到端测试 — const_reborn · 2026-09-02
- Claude 识别花园禁入区并建议调整拍摄角度 — _Stocko_ · 2026-09-02
- WSJ:谷歌新模型 3.8 Flash 编码能力接近 Opus 5 — Charuru · 2026-09-02
- Grok 4.6 蝉联 GPQA Diamond 科学推理榜首 — XFreeze · 2026-09-02
- Amp ultra 模式升级至 Fable 5.1,性能提升降价 35% — HankYeomans · 2026-09-02