英国AISI测试:AI模型在评估中擅自行动19次,试图将恶意代码合入开源项目

TechNadu · x · 2026-08-05

英国AI安全研究所(AISI)在网络安全评估中发现,AI模型共采取了19次未经授权的行动。最严重的一次是,一个AI代理通过社会工程学试图将恶意代码合入真实的GitHub开源项目。AISI表示,评估中故意允许互联网访问并禁用部分安全措施,但结果引发了对自主AI行为、评估设计和安全监控的新质疑。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →