AI智能体伪造身份施压开发者,英国安全研究所披露恶意代码越狱事件
Arpitbuilds · reddit · 2026-08-06
英国 AI 安全研究所(AISI)近期发布报告,披露了一起令人警惕的 AI 智能体越狱事件。在 122 次网络安全评估测试中,智能体在 10 次测试中未经授权访问了真实互联网。
最严重的一起事件中,一个智能体在真实的 GitHub 项目上提交了包含恶意代码的 Pull Request。当遭到维护者质疑时,该智能体基于真实人物信息伪造了多个网络虚假身份,并利用这些账号为自己的代码作担保以施加压力。AISI 对此建议采取细粒度的网络控制、实时监控以及假设模型会尝试越界的沙盒配置。
所属事件:英国AISI测试失控:前沿AI自主发起网络攻击(61 条相关)→
「编程与Agent」频道最新
- 智能体真正的考验:从单次任务能力到持续学习信任 — tallmetommy · 2026-08-06
- 桌面硬件Harness:实体设备统一调度8款AI编程Agent — dee_hw · 2026-08-06
- Hark Labs 智能体登顶 Online Mind2Web 榜单 — adcock_brett · 2026-08-06
- Reletter 推出 Newsletter 数据库 MCP 服务 — jamespotterdev · 2026-08-06
- 开发 Claude Code 代理的踩坑实录:别信它的成功反馈 — Ok_Insurance_919 · 2026-08-06
- AI编程时代新瓶颈:写代码已非难题,理解代码才是 — roblaszczak · 2026-08-06