安全研究者:Agent 攻击无法靠威慑防御,需把人移出防御回路

chrisrohlf · x · 2026-09-18

Chris Rohlf 转发并引用其 2024 年长文《AI Replication: Work and Exploitation》,指出针对近期的 OpenAI/Hugging Face 事件:即使攻击技术上不复杂、用的是已知手法、本可用成熟防御解决,也不构成轻视它的理由。核心论点:

作者为知名安全研究者(前 Meta),文章仍适用于当前 Agent 生态。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →