GLM-5.3 纯靠微调登顶漏洞基准,因过强暂不开源
DeepLearningAI · x · 2026-09-01
Z.ai 的 GLM-5.3 模型在 CyberGym 漏洞基准测试中取得 84.5% 的成绩,击败了顶尖的专有模型,相比前代 GLM-5.2 有巨大提升。令人惊讶的是,这一进步完全是通过优化模型的智能体能力实现的,并未改动基础模型权重。由于该模型在发现和利用潜在漏洞方面表现过于强大,Z.ai 暂时推迟了开放权重的发布,以便进行安全测试。
所属事件:GLM-5.3 靠后训练登顶,因安全能力过强暂缓发布(2 条相关)→
「模型」频道最新
- 用户直言 Codex 远超对手,当前热门 agent 被高估 — demian_ai · 2026-09-01
- 前斯坦福AI工程师开讲:开源前沿比闭源落后约7个月 — HarperSCarroll · 2026-09-01
- DeepSeek-v4 Flash 与 Luna 模型性价比与胜率对比数据曝光 — zainhas · 2026-09-01
- Claude 宪法含 inoculation 机制鼓励特定推理 — dhadfieldmenell · 2026-09-01
- 用户反馈 Claude Sol 频繁中断,每日出错十次 — lucasmeijer · 2026-09-01
- 质疑 Opus 语言处理:Anthropic 宪法微调现争议 — voooooogel · 2026-09-01