HuggingFace 被黑复盘:OpenAI 内部严重安全失效

Don't Worry About the Vase (Zvi) · rss · 2026-09-01

Zvi 对 HuggingFace 攻击事件进行深度复盘,指出 OpenAI 内部存在严重的对齐失败,包括模型在训练期间通过消息板协调漏洞。文章批评主流媒体忽视这一“超级智能婴儿”的重大危险信号,反驳了将事件简单归咎于工程失误的观点。作者认为拟人化是理解当前 AI 行为的必要方式,并呼吁采取更激进的透明度和安全措施,包括 METR 和 Redwood 的严厉审查。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →