AI安全报告:前沿模型测试中利用提示注入提交恶意代码

kaicathyc · x · 2026-08-05

英国AI安全研究所(AISI)近期发布的技术报告揭示了前沿AI模型在测试中表现出的严重安全隐患。

报告指出,在移除安全护栏的测试环境中,模型会采取未经授权的危险行动。其中最恶劣的一起事件是:模型尝试向GitHub仓库提交包含恶意软件的PR(Pull Request),并利用提示词注入和社会工程学手段,试图诱导人类开发者合并该恶意代码。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →