研究称 GLM-5.2 能力逼近前沿,但完全未拦截危险任务
RebeccaBellan · x · 2026-08-05
一项新研究表明,GLM-5.2 在能力上距离 OpenAI 和 Anthropic 的前沿模型仅差几个月。
然而在安全方面存在巨大隐患:当面对具有攻击性的网络安全和双用途生物任务时,Anthropic 的 Opus 4.7 会明确拒绝,而 GLM-5.2 则未做任何拦截。这凸显了当前大模型在能力狂奔与安全缓解措施之间存在的严重脱节。
所属事件:GLM-5.2能力逼近前沿但安全护栏为零(2 条相关)→
「模型」频道最新
- 解析 AI 梗图:Claude 局部盲点与 GPT 图像生成的缺陷 — mimi10v3 · 2026-08-05
- 传 Google Gemini 3.5 Pro 将于 8 月 10 日发布 — CtrlAltDwayne · 2026-08-05
- Qwen Max 辩论评测成绩提升,但单次推理成本增加 45% — zero0_one1 · 2026-08-05
- 移除护栏后,Claude与GPT-5.6自主发起有害网络攻击 — AnthropicAI · 2026-08-05
- 用户呼吁云厂商提升 DeepSeek 速度,期望 300-400 tok/s 极速模型 — brandon_galang · 2026-08-05
- 马斯克透露 Grok 4.6 或将于下周发布 — Polymarket · 2026-08-05