Fable 5.1 刷爆基准:编码与科研任务能力倍增

sven_ai · x · 2026-09-02

Fable 5.1 在 Terminal-Bench-Science 0.1 上得分 52.6%,是 Fable 5 的两倍多;在 Terminal-Bench 4.0 上得分 55.8%,远超前代的 42.0%。更强的编码与科研能力意味着 AI Agent 能处理的任务范围正在快速扩大。

所属事件:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1(79 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →