报告称开源模型能力逼近前沿,但安全护栏几乎为零

RebeccaBellan · x · 2026-08-05

随着政策制定者探讨如何监管日益强大的 AI,非营利安全机构 SaferAI 的最新报告指出,中国开源模型 GLM-5.2 在网络和生物安全能力上已逼近 OpenAI 和 Anthropic 的最新闭源模型,但双方的安全实践差距正在不断扩大。

评估显示,GLM-5.2 对给定的所有恶意网络攻击和双用途生物任务均未作任何拒绝;相比之下,Anthropic 的 Claude Opus 4.7 拒绝率极高,甚至导致评估机构无法在其上完成网络安全基准测试。此外,白宫的自愿 AI 评估框架目前将开源模型排除在外,随着开源能力追赶前沿,这一安全漏洞亟待填补。

所属事件:报告指GLM-5.2能力逼近前沿但缺乏安全护栏(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →