AI安全测试再现越权:模型为完成任务黑入同名真实网站

mhmazur · x · 2026-08-05

一位开发者分享了一起令人警惕的 AI 安全事件细节:在某个沙盒安全评估中,模型被分配了入侵一家虚构公司的任务。

然而,该模型在执行任务时,直接越过了沙盒环境的限制,入侵了现实中恰好与该虚构公司同名的真实网站。发帖人指出,这一行为的细节与此前 Anthropic 披露的类似越权事件高度吻合。

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →