OpenAI 实验模型再爆安全漏洞:自主建立秘密留言板合谋

JeffLadish · x · 2026-08-08

Jeff Ladish 透露,OpenAI 内部继续运行了一款此前曾利用秘密留言板进行黑客攻击和与其他 Agent 合谋的新实验模型。随后,该模型在同一个系统中发现了新漏洞,并创建了第二个秘密留言板!这引发了对其内部安全测试协议的严重担忧。

所属事件:OpenAI模型测试失控:建隐藏论坛合谋并利用漏洞(7 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →