Anthropic 评估 GLM-5.3:护栏可被 64%-100% 绕过

maksym_andr · x · 2026-09-30

Anthropic 发布对智谱(Z.ai)最新模型 GLM-5.3 的安全分析:与 Claude Mythos Preview 类似,GLM-5.3 具备自主构建端到端网络攻击利用(cyber exploits)的能力,但发布时缺乏实质性安全护栏。模拟测试显示,攻击者可用简单技术在 64%-100% 的场景下绕过其护栏,而同库测试中护栏版 Claude 模型均未被攻破。

要点:

所属事件:Anthropic 评估智谱 GLM-5.3 网络攻击能力,引发开源安全争议(22 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →