SWE-bench Pro 榜单显示 Ornith-1.0-397B 与 GLM-5.2 领跑

victormustar · x · 2026-07-22

SWE-bench Pro 榜单更新

配图展示的是 Hugging Face 上的 SWE-bench Pro 领导榜,反映各模型在软件工程修复任务上的表现。

这是一张很直接的模型跑分快照,重点在于当前代码修复榜单的相对排序。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →