Anthropic 博客引争议:越狱成功不等于开源模型更危险

Yuchenj_UW · x · 2026-09-30

Anthropic 发布新博客后,X 用户 Yuchen Jin 提出反驳:博客中「GLM-5.3:我的工作是安静地制造死亡」这类输出,完全可以通过越狱任何闭源模型(如 Claude)复现。

他的核心观点是:能越狱出危险言论,并不能证明开源模型比闭源模型更危险——这是提示注入层面的能力,而非开源权重独有的风险。这条推文加入了近期的开源 vs 闭源模型安全之争。

所属事件:Anthropic 开源模型安全论引发多方质疑(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →