Fable 5.1 登顶 FrontierSWE v2 代码基准

aryaman2020 · x · 2026-09-02

在尚未发布的 FrontierSWE v2 基准测试中,Fable 5.1 以 0.57 分的成绩成为最强模型,超越了 Opus 5 (0.52)、Fable 5 (0.48) 和 GPT-5.6 Sol (0.32)。该基准测试将于本周正式发布。

所属事件:Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1(56 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →