报告称开源模型能力逼近前沿,但安全护栏几乎为零
RebeccaBellan · x · 2026-08-05
随着政策制定者探讨如何监管日益强大的 AI,非营利安全机构 SaferAI 的最新报告指出,中国开源模型 GLM-5.2 在网络和生物安全能力上已逼近 OpenAI 和 Anthropic 的最新闭源模型,但双方的安全实践差距正在不断扩大。
评估显示,GLM-5.2 对给定的所有恶意网络攻击和双用途生物任务均未作任何拒绝;相比之下,Anthropic 的 Claude Opus 4.7 拒绝率极高,甚至导致评估机构无法在其上完成网络安全基准测试。此外,白宫的自愿 AI 评估框架目前将开源模型排除在外,随着开源能力追赶前沿,这一安全漏洞亟待填补。
所属事件:报告指GLM-5.2能力逼近前沿但缺乏安全护栏(3 条相关)→
「模型」频道最新
- 实测 LFM2.5-2.6B:推理快但智力受限,适合低风险任务 — NickPassig · 2026-08-05
- Claude Opus 性格引争议,官方文档提供提示词技巧 — daniel_mac8 · 2026-08-05
- Ling-3.0-flash本地实测:单机80 tok/s解码 — niacolhealth · 2026-08-05
- 实测 MiniMax H3:对流行文化 IP 细节掌握不足 — FreeTheClanks · 2026-08-05
- Ant Ling 3.0 Flash 发布 BF16 与 FP8 官方版 — FellMentKE · 2026-08-05
- 商汤开源 8B 多模态模型 SenseNova U1.5 — FellMentKE · 2026-08-05