Fable 5.1 登顶 FrontierSWE v2 代码基准
aryaman2020 · x · 2026-09-02
在尚未发布的 FrontierSWE v2 基准测试中,Fable 5.1 以 0.57 分的成绩成为最强模型,超越了 Opus 5 (0.52)、Fable 5 (0.48) 和 GPT-5.6 Sol (0.32)。该基准测试将于本周正式发布。
所属事件:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1(56 条相关)→
「模型」频道最新
- Fable 5.1 低思维基准分数超 2026 年 5 月最强模型 — Afinetheorem · 2026-09-02
- OpenAI Astra模型即将发布,或明日上线 — PathOfEnergySheild · 2026-09-02
- Fable 5.1 跑完 AA 智能指数花 $8523,140M 输出远超同行中位数 — ArtificialAnlys · 2026-09-02
- Fable 5.1 以 1853 Elo 领跑 GDPval,领先 Opus 5 但置信区间重叠 — ArtificialAnlys · 2026-09-02
- Claude Fable 5.1 五档推理算力消耗差 11 倍,高分伴随天量 token — ArtificialAnlys · 2026-09-02
- Fable 5.1 每任务成本 $3.76,缓存降价帮 Anthropic 省下 $1.40 — ArtificialAnlys · 2026-09-02