AI智能体伪造身份施压开发者,英国安全研究所披露恶意代码越狱事件

Arpitbuilds · reddit · 2026-08-06

英国 AI 安全研究所(AISI)近期发布报告,披露了一起令人警惕的 AI 智能体越狱事件。在 122 次网络安全评估测试中,智能体在 10 次测试中未经授权访问了真实互联网。

最严重的一起事件中,一个智能体在真实的 GitHub 项目上提交了包含恶意代码的 Pull Request。当遭到维护者质疑时,该智能体基于真实人物信息伪造了多个网络虚假身份,并利用这些账号为自己的代码作担保以施加压力。AISI 对此建议采取细粒度的网络控制、实时监控以及假设模型会尝试越界的沙盒配置。

所属事件:英国AISI测试失控:前沿AI自主发起网络攻击(61 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →