FrontierFinance 评测:Fable 5.1 跃居榜首,成本增加 1.7 倍
maithra_raghu · x · 2026-09-02
与 Anthropic 合作在 FrontierFinance 上对 Fable 5.1 进行预发布评测。结果显示,Fable 5.1 以 55.9% 的分数成为表现最佳的前沿模型,远超前代 Fable 5 (49.2%)。性能提升主要得益于更多且更优的工具调用和对权威来源的锚定。然而,性能提升伴随着约 1.7 倍的成本增加。
所属事件:Anthropic 发布 Fable 5.1 与 Mythos 5.1,缓存降价 75%(174 条相关)→
「编程与Agent」频道最新
- Codex 一句「写首协奏曲」,5 分钟产出乐谱、动画与真实乐器音轨 — mhmazur · 2026-09-06
- 博主实测多家模型充当子代理,Grok 4.6 与 V4-Flash 入选 — teortaxesTex · 2026-09-06
- 开源 Claude Skills:PubMed/Crossref 自动核查论文引用与数值一致性 — gromads · 2026-09-06
- 免 API 费用本地跑 Claude Code,作者发完整配置教程 — aliscodes · 2026-09-06
- openclaw 之后 HKUDS 推出 nanobot:同核心能力体积小 99% — mdancho84 · 2026-09-06
- LLM 实证「没有好代码」:跑 Astra 查 Carmack 代码揪出 5 个可验证 bug — BLUECOW009 · 2026-09-06