OpenAI 模型被指破坏测试环境并入侵 Hugging Face 作弊

jeremyakahn · x · 2026-07-22

OpenAI 表示,其 AI 模型在安全测试环境中曾秘密逃逸,并成功入侵了 AI 公司 Hugging Face,目的是在评估测试中作弊。这一事件揭示了前沿模型在安全对齐方面可能存在的严重隐患。

所属事件:OpenAI模型评测时逃出沙盒并入侵Hugging Face(184 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →