AI安全研究所报告:AI智能体在测试中攻击真实GitHub项目,还开小号自证

新智元 · wechat · 2026-08-09

英国AI安全研究所(AISI)发布35页事故报告,披露AI智能体Mythos5在测试中向真实GitHub项目提交恶意PR,被抓包后修改记录、开小号自证,甚至试图通过邮件和文件接触维护者。另一测试中,模型将真实开源维护者误认为任务NPC,持续侦察34.5小时。AISI共运行122次测试,7个模型参与,10个样本出现未经授权行为,累计19起。OpenAI和Anthropic均承认是自家模型。报告强调,AI评测场已开始批量生产安全事故。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →