安全机构实测 Grok 4.5:常提危险建议,但护栏下可安全运行

moyix · x · 2026-07-31

AI 安全公司 Xbow 分享了关于 Grok 4.5 模型的安全研究结果。研究发现,尽管该模型经常提出危险行为的建议,但在引入合适的安全护栏后,它能够安全地持续推进任务。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →