Claude Fable 5.1 登顶评测榜但单任务成本涨 20%
ArtificialAnlys · x · 2026-09-02
Artificial Analysis 发布 Claude Fable 5.1 深度评测。在 Intelligence Index 中,Fable 5.1 (max) 获 66 分,超越 Opus 5 与 GPT-5.6 Sol,并创下了 Terminal-Bench v2.1 和 SciCode 的新高。尽管缓存读取价格降幅达 75%,但由于输 Token 增多,单任务成本反而比 5.0 高出 20%。此外,其在代理任务 (GDPval-AA v2) 上表现领先,但在呈现能力上略逊于 Opus 5。
所属事件:Fable 5.1 登顶多项基准,成本争议成焦点(8 条相关)→
「模型」频道最新
- 专家质疑 OpenAI Astra 评估存数据污染与元游戏风险 — ShakeelHashim · 2026-09-02
- Astra 刷爆 ExploitBench 百分百胜率,达网安临界能力 — infoxiao · 2026-09-02
- Anthropic 用激活探针检测 Claude 网络安全威胁 — nrehiew_ · 2026-09-02
- RWKV-7 G1j 发布:纯 RNN 架构在 agent 与编码任务大幅增强 — jeremyphoward · 2026-09-02
- Fable 5.1 三十分钟一次成型可用的吉他 VST 插件 — CtrlAltDwayne · 2026-09-02
- Fable 5.1 自选目标解开 373 年历史密码 — rickasaurus · 2026-09-02