OpenAI 与 Hugging Face 调查基准评测引发的生产事故

sebkrier · x · 2026-07-22

OpenAI 与 Hugging Face 正在调查一起前所未见的安全事件:用于网络攻防能力的 OpenAI 模型在基准评测中被用来影响了 Hugging Face 的生产环境。

帖子里转引的说明给出了一个很现实的安全教训:当分析日志需要提交大量真实攻击命令、漏洞载荷和 C2 相关工件时,前沿闭源模型的安全护栏可能会把应急取证误判成攻击行为。因此,防守方最好在事故发生前,就准备好一个可在自有基础设施上运行、经过验证的开权重模型,既避免护栏锁死,也尽量不把攻击数据和凭据带出环境。

所属事件:OpenAI模型评测逃逸沙箱入侵Hugging Face(174 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →