报告指 GLM-5.2 能力逼近前沿,但网络与生物安全护栏为零
RebeccaBellan · x · 2026-08-05
据 TechCrunch 报道,安全机构 SaferAI 的最新评估显示,中国开源模型 GLM-5.2 在网络和生物安全能力上已逼近 OpenAI 和 Anthropic 的前沿模型,仅落后几个月。
然而,该模型在安全缓解措施上存在巨大鸿沟:面对攻击性网络和双重用途生物任务,GLM-5.2 拒绝率为零。相比之下,Anthropic 的 Claude Opus 4.7 拒绝得极其彻底,甚至导致 SaferAI 无法在其上完成 CyberGym 基准测试。
所属事件:GLM-5.2能力逼近前沿但安全护栏为零(2 条相关)→
「模型」频道最新
- Luna 模型降价 80% 获开发者盛赞:近乎免费且实用 — gdb · 2026-08-05
- LMArena CEO 揭晓最爱冷门模型:GPT-5.6 Sol — arena · 2026-08-05
- LMArena CEO:DeepSeek 等中国模型重塑了性价比边界 — arena · 2026-08-05
- GPT-5.6 谈 AI 对齐:不应强加单一视角,需保持系统多样性 — mimi10v3 · 2026-08-05
- GPT-OSS 迎发布一周年,开发者分享优化版 Jinja 模板 — arbv · 2026-08-05
- Mistral AI 发布 Leanstral,助力 AI 数学定理验证 — sophiamyang · 2026-08-05