Fable 5.1 登顶金融基准但推理成本大增

与 Anthropic 合作进行的 FrontierFinance 预发布评测显示,Fable 5.1 以 55.9% 的分数成为表现最佳的前沿模型,跃居榜首,但成本较此前增加约 1.7 倍。另据 Artificial Analysis 的完整跑分,该模型(Adaptive Reasoning、max effort 配置)完成 AA 智能指数测试花费 8523 美元,产生 1.4 亿 token 输出,远超同行中位数。

2026-09-02 ~ 2026-09-02 · 2 条相关