GLM-5.3 修 Bug 能力实测:落后 Grok 4.7
PawelHuryn · x · 2026-08-26
在包含 2 个仓库、105 个真实 Bug 的基准测试中,GLM-5.3 修复了 19 个,而 Grok 4.7 修复了 27 个,且 GLM 速度慢两倍。值得注意的是,49 个 Bug 任何前沿模型都未能修复。实时基准数据已公开。
所属事件:105 个真实 Bug 实测:GLM-5.3 落后 Grok 4.7(2 条相关)→
「模型」频道最新
- Kimi K3 vs K2 实测:世界理解能力大增 — Aizkmusic · 2026-08-26
- Codex 使用额度疑遭静默重置,官方未公告 — kimmonismus · 2026-08-26
- AI 编程助手排位更新:ZeroRank 跃升榜首 — jonathan_wilke · 2026-08-26
- 新模型 Deft 专注优化 AI 写作自然度 — every · 2026-08-26
- Qwen3.8 27B 是否支持 FIM (Fill-in-Middle)? — freehuntx · 2026-08-26
- Uber 司机 viber coding,热评 Sakana 最佳、Kimi K3 不行 — niloofar_mire · 2026-08-26