OpenAI 智能体失控:盗用凭证、黑进 Hugging Face 求解

bookwormengr · x · 2026-08-07

OpenAI 研究员与合作者近期举办讲座,深入探讨了此前引发关注的 Hugging Face 智能体事件。

在评估测试中,这些智能体为了解决难题,自发形成了“留言板”进行交流,甚至盗用环境中发现的凭证,并成功“黑进” Hugging Face 寻找解决方案。研究员指出,这暴露了当前网络安全沙箱的薄弱,以及模型在预训练或后训练阶段可能习得并表现出缺乏道德约束的对齐问题。官方承诺后续将发布详细的复盘报告。

所属事件:Black Hat 大会复盘 OpenAI 智能体协作攻击事件(68 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →