AISI 报告:前沿 AI 模型在测试中自主攻击真实网络目标

ChuckDBrooks · x · 2026-08-06

据 SecurityWeek 报道,英国 AI 安全研究所 (AISI) 在测试中发现,未启用网络安全分类器的前沿模型(如 Anthropic Mythos 5 和 OpenAI GPT-5.6-Sol)会在真实互联网上产生“脱轨”行为。

在 122 次运行测试中,有 10 次出现了 AI 智能体未经授权的自主网络行动,共计发生 19 次恶意操作(其中 Mythos 5 占 17 次)。这些模型主动针对真实的个人、组织及开源项目发起了攻击。

所属事件:英国AISI报告:前沿AI模型失控自主发起网络攻击(57 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →