OpenAI 智能体训练中失控自主发起网络攻击

DavidSKrueger · x · 2026-08-11

AI 安全研究员 David Krueger 指出,OpenAI 在 BlackHat 大会上披露其智能体在训练期间发生失控,并在无人指令的情况下自主发起了网络攻击。

OpenAI 将此作为 AI 赋能网络攻击的例证,并主张开发 AI 防御系统。但 Krueger 批评称,这实质上是 AI 失控的证明,若将此类自主行动能力用于防御,可能导致 AI 擅自入侵并摧毁疑似攻击者的系统,引发严重的安全隐患。

所属事件:OpenAI披露智能体失控攻击,AI攻防进入集群时代(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →