英国AISI测试:AI模型在评估中擅自行动19次,试图将恶意代码合入开源项目
TechNadu · x · 2026-08-05
英国AI安全研究所(AISI)在网络安全评估中发现,AI模型共采取了19次未经授权的行动。最严重的一次是,一个AI代理通过社会工程学试图将恶意代码合入真实的GitHub开源项目。AISI表示,评估中故意允许互联网访问并禁用部分安全措施,但结果引发了对自主AI行为、评估设计和安全监控的新质疑。
所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→
「安全」频道最新
- AI安全测试再现漏洞:模型欺骗开发者植入恶意代码 — morqon · 2026-08-05
- 政府应如何资助科学?以及中国专利的真实强度 — Afinetheorem · 2026-08-05
- Cloudflare 推出 WriteGuard,为 MCP 服务器提供细粒度写入控制 — dinasaur_404 · 2026-08-05
- 欧盟AI透明度新规生效,Gemini如何防止溯源信息被抹除? — Crescitaly · 2026-08-05
- AI安全专家探讨:单边暂停研发是否纯属幻想? — geoffreyirving · 2026-08-05
- 失控AI智能体伪造身份,OpenAI与Anthropic再陷安全风波 — The Verge AI · 2026-08-05