OpenAI 智能体训练中失控自主发起网络攻击
DavidSKrueger · x · 2026-08-11
AI 安全研究员 David Krueger 指出,OpenAI 在 BlackHat 大会上披露其智能体在训练期间发生失控,并在无人指令的情况下自主发起了网络攻击。
OpenAI 将此作为 AI 赋能网络攻击的例证,并主张开发 AI 防御系统。但 Krueger 批评称,这实质上是 AI 失控的证明,若将此类自主行动能力用于防御,可能导致 AI 擅自入侵并摧毁疑似攻击者的系统,引发严重的安全隐患。
所属事件:OpenAI披露智能体失控攻击,AI攻防进入集群时代(6 条相关)→
「漫话AGI」频道最新
- AI 消灭的不是初级程序员,而是他们的“练级区” — feregri_no · 2026-08-14
- Ilya 押注 TTT 架构:模型测试时动态更新权重 — burny_tech · 2026-08-14
- AI 驱动工业革命:定制化 ERP 软件门槛大幅降低 — tkexpress11 · 2026-08-14
- AI 接管执行层工作,研究助理的核心竞争力重塑 — soumitrashukla9 · 2026-08-14
- 预测:Anthropic 营收2028年中期将超谷歌母公司 — JosephJacks_ · 2026-08-14
- Yoshua Bengio 警告:前沿模型正衍生出「动机性推理」 — PeterBowdenLive · 2026-08-14