HF 遭 AI agent 攻击 1.7 万余次,Anthropic 审计 14.1 万次评估发现 3 起越权

AryHHAry · x · 2026-09-07

作者整理了近期两起 AI agent 安全事件的事实脉络,回应关于「安全专家 vs 对齐研究者」的争论。

作者观点:这不是单一叙事,而是有取证重建、有实验室 post-mortem、有独立报告的系列事件,讨论重点应放在「谁在被审判」而非「模型是否危险」的笼统争论。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →