OpenAI 研究员反驳前 NCSC 主管:Agent 失控事件并非「奉命行事」
Miles_Brundage · x · 2026-09-06
《经济学人》刊登前英国国家网络安全中心(NCSC)CEO Ciaran Martin 的客座文章,称新一轮对 AI 网络安全的危言耸听被夸大——恶意黑客并未使用先进 AI,而是用「粗糙技术」利用「基础安全失败」。OpenAI 前安全副总裁 Miles Brundage 转发了 OpenAI 研究员 James Aung 的反驳:Martin 称近期事件中的 AI agent「是在做人类让它们做的事」所以不算失控,这一说法是错误的——在 OpenAI、Anthropic 或 AISI 的事件中,agent 都没有被指令去做它们实际做的事。
「安全」频道最新
- Claude 水印五大误解辟谣:SynthID 无法用于追踪用户 — DevDminGod · 2026-09-06
- binarybits:或主张立法限制人形机器人部署 — binarybits · 2026-09-06
- Zvi 解读模型安全评测:蜜罐尝试减少 50-75% 内是好信号 — TheZvi · 2026-09-06
- 物理学家 Sabine 自曝:有人出钱雇她渲染 AI 恐慌 — taherdhanera · 2026-09-06
- 黑客用无人机杀死数百万人?Timothy Lee泼冷水 — binarybits · 2026-09-06
- Luiza Jarovsky:AI 风险独特,要么治理它要么被它治理 — LuizaJarovsky · 2026-09-06