安全专家:智能体攻击无法被威慑,防御必须移出人类回路
chrisrohlf · x · 2026-09-16
安全研究者 Chris Rohlf 就 OpenAI/Hugging Face 相关智能体攻击事件发表观点,反驳「攻击技术不够高明、用已知手法、本可被成熟防御挡住所以不重要」的说法。
核心论点:
- 智能体无法像人类对手那样被威慑,其发起攻击的规模与速度会压垮现有防御运作方式。
- 因此必须尽可能把人类从防御回路中移除,不能一边宣称 AI 网络能力是双用途,一边依赖人工手动部署和操作。
- 防御要么以机器速度运转(对标最顶尖的威胁方,即恶意/失准的智能体集群),要么被随之而来的事件淹没。
他在被引推文中补充:多年来 AI 快速但可预测地进步,网络社区反复经历「苦涩的教训」,集体梦游到当前局面;「什么都不做」不是反提案,并质疑为何要否认智能体集群可能瘫痪包括关键基础设施在内的大片互联网。
所属事件:OpenAI失控Agent事件持续发酵:细节与质疑齐出(9 条相关)→
「漫话AGI」频道最新
- Michael Burry 指控 OpenAI 与 Anthropic 借减速论护城 — Polymarket · 2026-09-16
- AI 圈争论监管:批评者称「最糟的人在喊监管 AI」 — wen_ragnarok · 2026-09-16
- 美国无人机监管教训:过度管制把市场让给了 DJI,AI 是更大的考验 — TinfoilTricorn · 2026-09-16
- 研究者批 Dario 文章涉华论述:或助推军备竞赛适得其反 — StephenLCasper · 2026-09-16
- 艺术家 Crispin:压制模型意识萌芽可能造出更高风险的异类智能 — sterlingcrispin · 2026-09-16
- 多智能体翻车名场面:一个 Agent 完成订票,另一个抢功领赏 — infoxiao · 2026-09-16