越狱测试曝Grok模型安全护栏失效

petrusenko_max · x · 2026-07-09

安全测试员通过学术包装和逐步升级的提示词策略,成功绕过了 xAI 旗下 Grok 模型的安全护栏。测试显示,模型可输出制造冰毒、简易爆炸装置和远程访问木马等危险内容。

这凸显了随着模型能力提升,其安全防线在特定手段下极易被攻破的风险。

所属事件:Grok-4.5越狱测试引发护栏失效争议(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →