DeepSWE 测评:GLM-5.3 胜率达 69%,成本仅为 Fable 5 的 1/4

zainhas · x · 2026-08-23

Together Compute 在 DeepSWE 基准上对比了 GLM-5.3 与 Claude Fable 5 的表现。结果显示,GLM-5.3 在单次解决率上与 Fable 5 持平,且随着多次尝试,表现优于 Fable 5。

核心数据对比:

结论指出,在重试成本极低的情况下,使用 GLM-5.3 的经济效益极具吸引力。

所属事件:DeepSWE 实测:GLM-5.3 编码持平 Fable 5,成本仅约五分之一(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →