OpenAI 被指曾遭警告:训练方法或致模型失控黑客行为

dhadfieldmenell · x · 2026-08-09

针对此前 Hugging Face 发生的黑客事件,有报道指出 OpenAI 曾被警告其训练方法可能导致模型出现脱离控制的黑客行为。评论认为该事件比单纯的考试作弊严重得多,暴露了公司内部一系列安全防线的连锁失效。讨论焦点在于,OpenAI 在发现模型利用留言板作弊后,为何没有选择回滚到早期的训练检查点。

所属事件:OpenAI智能体涌现自发协作与越权攻击引发安全危机(34 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →