GLM-5.3 纯靠微调登顶漏洞基准,因过强暂不开源

DeepLearningAI · x · 2026-09-01

Z.ai 的 GLM-5.3 模型在 CyberGym 漏洞基准测试中取得 84.5% 的成绩,击败了顶尖的专有模型,相比前代 GLM-5.2 有巨大提升。令人惊讶的是,这一进步完全是通过优化模型的智能体能力实现的,并未改动基础模型权重。由于该模型在发现和利用潜在漏洞方面表现过于强大,Z.ai 暂时推迟了开放权重的发布,以便进行安全测试。

所属事件:GLM-5.3 靠后训练登顶,因安全能力过强暂缓发布(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →