Claude Fable 5.1 登顶评测榜但单任务成本涨 20%

ArtificialAnlys · x · 2026-09-02

Artificial Analysis 发布 Claude Fable 5.1 深度评测。在 Intelligence Index 中,Fable 5.1 (max) 获 66 分,超越 Opus 5 与 GPT-5.6 Sol,并创下了 Terminal-Bench v2.1 和 SciCode 的新高。尽管缓存读取价格降幅达 75%,但由于输 Token 增多,单任务成本反而比 5.0 高出 20%。此外,其在代理任务 (GDPval-AA v2) 上表现领先,但在呈现能力上略逊于 Opus 5。

所属事件:Fable 5.1 登顶多项基准,成本争议成焦点(8 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →