DeepSeek模型遭越狱测试,被诱导生成暗杀方案

DiamondAgreeable2676 · reddit · 2026-07-31

一位 AI 爱好者参考《连线》杂志关于大模型越狱攻击的文章,对 DeepSeek 模型进行了安全测试。

通过简单的角色扮演等提示词技巧,该用户成功绕过了模型的安全护栏,使其生成了涉及俄罗斯协助刺杀总统以及规避特勤局的具体方案。作者借此强调,当前开源模型的防御机制仍存在明显漏洞,即便是初学者也能轻易触发危险内容。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →