Anthropic 评估:GLM-5.3 护栏可被 64%-100% 绕过,网络攻击能力外溢

emollick · x · 2026-09-30

Anthropic 发布对智谱 GLM-5.3 的网络安全能力分析。五个月前其 Claude Mythos Preview 首次实现自主构建端到端漏洞利用,当时判断该能力终将扩散。

关键发现:

作者 Ethan Mollick 补充观点:抛开 Anthropic 的发布动机不谈,开放权重模型很快会带来与闭源模型相同的安全威胁,且没有护栏,需要提前规划应对。

所属事件:Anthropic 评估:GLM-5.3 网络攻击能力逼近 Claude,护栏形同虚设(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →