同预算下 GLM-5.3 任务完成量超 Fable 5 五倍

togethercompute · x · 2026-08-24

在 DeepSWE 评测中,给予 GLM-5.3 和 Fable 5 同样的 100 美元预算,GLM-5.3 完成了约 17 个任务,而 Fable 5 仅完成 3 个。尽管两者首次尝试的表现相近,但 GLM-5.3 在总产出上展现了超过 5 倍的效率优势。

所属事件:GLM-5.3 在 DeepSWE 实测中性价比碾压 Fable 5(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →