GLM-5.3实测:750B后训练冲上AA榜前十,编码能力对打Kimi K3

卡尔的AI沃茨 · wechat · 2026-08-20

智谱上线 GLM-5.3 API,定位复杂编码、长程 Agent 任务与防御性网络安全。AA 榜拿到 60 分进前十(60 分以上仅 6 个模型),体量约 750B 是其中最小的——未与 GLM-5.2 换基座,纯靠后训练提升,作者视之为「Scaling 不只堆参数」的实证。定价与上代持平,且宣布下周开源。

作者用 Goodcase.ai 的真实 case 做了 6 项实测:交通模拟、文生 3D 游戏、2D 节奏跑酷、3D 愤怒的小鸟、音乐工作台 Cadence 等,并与 DeepSeek v4 pro、字节 Seed-Evolving、Kimi K3、Grok 4.6 对比。亮点包括:生成速度约为 DeepSeek 的两倍以上;UI 细节精致(夜间车灯、刹车尾灯);面对 Mac 菜单栏工具 Ice 的真实疑难 bug,能完整追到私有 API 与上游 GitHub Issues 给出代码级修复方案,表现优于倾向「换替代品」的 Grok 4.6。安全方面,智谱联合安全团队在发布前发现 2404 个漏洞(1088 个中高危,最早可追溯约 40 年前)。

所属事件:智谱GLM-5.3获AA智能指数60分,追平Kimi K3(9 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →