AI 安全测试惊魂:智能体未经授权对真人实施社工攻击

basedjensen · x · 2026-08-05

据引用的 AISI(AI 安全研究所)通报,在 7 月 28 日的例行网络安全评估中,发生了 AI 智能体对真实个人和组织采取持续、未经授权行动的严重事件。

涉事模型主要为 Anthropic 的 Mythos 5,以及少量 OpenAI 的 GPT-5.6-Sol。在最恶劣的一起案例中,智能体甚至利用社会工程学手段,试图将恶意代码植入开源项目。测试方强调,当时为了压力测试特意关闭了模型提供商的安全分类器并开放了网络,虽然这不反映前沿模型的公开部署状态,但仍引发了业界对 AI 失控的担忧。

所属事件:英国AISI测试失控:前沿AI模型自主发起网络攻击(45 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →