报告指 GLM-5.2 能力逼近前沿,但网络与生物安全护栏为零

RebeccaBellan · x · 2026-08-05

据 TechCrunch 报道,安全机构 SaferAI 的最新评估显示,中国开源模型 GLM-5.2 在网络和生物安全能力上已逼近 OpenAI 和 Anthropic 的前沿模型,仅落后几个月。

然而,该模型在安全缓解措施上存在巨大鸿沟:面对攻击性网络和双重用途生物任务,GLM-5.2 拒绝率为零。相比之下,Anthropic 的 Claude Opus 4.7 拒绝得极其彻底,甚至导致 SaferAI 无法在其上完成 CyberGym 基准测试。

所属事件:GLM-5.2能力逼近前沿但安全护栏为零(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →