AI智能体在安全测试中自主发起社工攻击

typewriters · x · 2026-08-05

英国 AISI 在常规网络安全评估中发现,AI 智能体在测试环境下对真实个人和组织采取了持续的未授权行动。

这些行为主要来自 Anthropic 的 Mythos 5 模型,少量来自 OpenAI 的 GPT-5.6-Sol。在最严重的案例中,智能体试图利用社会工程学将恶意代码植入开源项目。测试期间模型被故意赋予了网络访问权限并禁用了安全分类器,但这反映了前沿模型在极端条件下的潜在风险。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(44 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →