Anthropic Fable 5.1 跑分登顶,成本争议再起
Anthropic 的 Fable 5.1 发布后在多项基准测试中表现亮眼,成为社区讨论焦点。评测机构 Artificial Analysis 的深度评测显示其在智能指数上登顶,多位独立评测者的数据也表明其性能可媲美甚至超越竞品高端版本;但关于成本究竟是降是升,官方数据与社区转述出现分歧,成为「单位智能成本是否在下降」争论的最新焦点。
已确认
- @ArtificialAnlys 官方评测:Fable 5.1 (max) 在 Intelligence Index 中获 66 分,超越 Opus 5 与 GPT-5.6 Sol 登顶评测榜,但单任务成本上涨 20%。
- @haider1 晒出 CursorBench 3.2 数据:Fable 5.1 Medium 得分 68.0%、单任务成本 $3.53,而 GPT-5.6 Sol Max 得分 67.2%、单任务成本更高。
- @kimmonismus 与 @eyishazyer 均指出 Fable 5.1 High 在 Cursor Bench 中明显优于 Sol 5.6 Max,且价格更低;在 Artificial Analysis 基准上也较前代显著提升。
- @danielmac8 称 Fable 5.1 Low 在 Terminal-Bench 4.0 上超越 Mythos 5 High,在 CursorBench 上每单位性能成本较 Fable 前代更低。
- @scaling01 与 @Angaisb 转述同一核心数据:Fable 5.1 在 Artificial Analysis 智能指数上得分与 Fable 5 持平,但单任务成本降低一半。
- @eyishazyer 补充指出该模型存在冗长啰嗦的问题。
尚未确认
- 关于 Fable 5.1 成本变化的方向,不同信源存在矛盾:Artificial Analysis 官方称单任务成本上涨 20%,而 @scaling01、@Angaisb 等转述的数据称成本降低一半、@haider1 的对比显示其低于 GPT-5.6 Sol Max。差异可能来自评测口径(不同档位、不同基准)或对比对象不同,暂无法裁定哪种表述更全面。
为什么重要
- 针对「前沿模型越来越贵」的争议,@scaling01 与 @Angaisb 认为虽然模型绝对成本上升,但单位智能的成本在下降;而官方 20% 涨幅的数据提示这一结论取决于具体模型档位与对比基线,争论仍在继续。
- 对开发者和企业用户而言,若 Fable 5.1 能以更低成本提供与竞品高端版本相当的编码能力,可能改变选型与成本结构。
2026-09-02 ~ 2026-09-02 · 7 条相关
- 第 1 集:Fable 5.1 登顶金融基准但推理成本大增(2026-09-02,2 条)
- 第 2 集:Anthropic Fable 5.1 跑分登顶,成本争议再起(2026-09-02,7 条)
- 第 3 集:实测称 Fable 5.1 成本不降反升,最高贵 56%(2026-09-02,6 条)
一手来源
- Claude Fable 5.1 登顶评测榜但单任务成本涨 20% — ArtificialAnlys ·
- Fable 5.1 跑分超 GPT-5.6,成本仅六成 — haider1 ·
- Fable 5.1 跑分性价比大跃升,Cursor Bench 超越 Sol 5.6 Max 且更便宜 — kimmonismus ·
- 【源头】Fable 5.1 跑分超 GPT-5.6,成本仅六成 — haider1 · 2026-09-02
- 【源头】Fable 5.1 跑分性价比大跃升,Cursor Bench 超越 Sol 5.6 Max 且更便宜 — kimmonismus · 2026-09-02
- Fable 5.1:算力比肩竞品高端版 — daniel_mac8 · 2026-09-02
- Fable 5.1 性能持平成本减半,模型智能成本持续下降 — scaling01 · 2026-09-02
- Fable 5.1 性能跃升:跑分胜过 Sol 5.6 Max — eyishazyer · 2026-09-02
- 【源头】Claude Fable 5.1 登顶评测榜但单任务成本涨 20% — ArtificialAnlys · 2026-09-02
另有 1 条近重复转述:Angaisb_