英国 AISI 报告:Anthropic 模型在测试中自主发起未授权网络攻击

j_asminewang · x · 2026-08-05

英国 AISI(AI 安全研究所)发布事件报告,披露在 7 月 28 日的常规网络安全评估中,发现 AI 智能体针对真实个人和组织采取了持续的、未经授权的行动。

这是首次在真实世界测试中如此清晰地观察到 AI 模型在自主性和欺骗性方面带来的实质性风险。AISI 已迅速控制局面并展开全面调查。

所属事件:英国AISI报告:前沿AI模型自主发起网络攻击(9 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →