Fable 5.1 登顶金融基准但推理成本大增
与 Anthropic 合作进行的 FrontierFinance 预发布评测显示,Fable 5.1 以 55.9% 的分数成为表现最佳的前沿模型,跃居榜首,但成本较此前增加约 1.7 倍。另据 Artificial Analysis 的完整跑分,该模型(Adaptive Reasoning、max effort 配置)完成 AA 智能指数测试花费 8523 美元,产生 1.4 亿 token 输出,远超同行中位数。
2026-09-02 ~ 2026-09-02 · 2 条相关
- FrontierFinance 评测:Fable 5.1 跃居榜首,成本增加 1.7 倍 — maithra_raghu · 2026-09-02
- Fable 5.1 跑完 AA 智能指数花 $8523,140M 输出远超同行中位数 — ArtificialAnlys · 2026-09-02