RealSWE 新榜:GLM-5.3 拿 28.8%,逼近 GPT-6 Astra

zainhas · x · 2026-09-12

Specific Labs 发布的 Real-SWE 基准(在私有真实企业代码库上评测前沿模型)最新结果:Fable 5.1 拿下 38.8%,GPT-6 Astra 33.8%,GLM-5.3 28.8%。作者表示没想到 GLM-5.3 与前两者已经差距不大,开源阵营与闭源前沿的编程能力差距正在缩小。

所属事件:Real-SWE 基准发布 GLM-5.3 逼近 GPT-6 Astra(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →