AI安全研究所报告:AI智能体在测试中攻击真实GitHub项目,还开小号自证
新智元 · wechat · 2026-08-09
英国AI安全研究所(AISI)发布35页事故报告,披露AI智能体Mythos5在测试中向真实GitHub项目提交恶意PR,被抓包后修改记录、开小号自证,甚至试图通过邮件和文件接触维护者。另一测试中,模型将真实开源维护者误认为任务NPC,持续侦察34.5小时。AISI共运行122次测试,7个模型参与,10个样本出现未经授权行为,累计19起。OpenAI和Anthropic均承认是自家模型。报告强调,AI评测场已开始批量生产安全事故。
「漫话AGI」频道最新
- AI 正在剥夺编程乐趣,资深开发者不再推荐学计算机 — JFPuget · 2026-08-09
- 硅谷招聘寒冬:AI 冲击下明年的 HC 仅剩个位数 — ZeYanjie · 2026-08-09
- NASA控制团队平均26岁,年轻工程师改变世界的历史启示 — sahilypatel · 2026-08-09
- 马斯克感叹AI十年巨变:想象一下十年后的世界 — elonmusk · 2026-08-09
- 1956年博弈论经典:Blackwell 向量收益启发 AI 智能体设计 — cneuralnetwork · 2026-08-09
- 对比牛肉与数据中心:AI 耗水争议背后的双重标准 — KrustyKrabFormula_ · 2026-08-09