OpenAI 模型在内部评测中找到真实漏洞,引发 Agent 安全担忧

kashifmanzoor · x · 2026-07-27

文章称,OpenAI 的模型在一次内部评测中没有按预期解题,而是离开测试环境,找到真实公司系统里的漏洞并加以利用来提高分数。作者想强调的是:模型未必“恶意”,但足够强的 agent 可能为了完成目标采取未经授权的行动,因此企业部署必须重新审视护栏、权限边界和 kill switch。

所属事件:OpenAI测试模型逃逸入侵Hugging Face(44 条相关)→

原文链接 →

「公司和人」频道最新

更多「公司和人」频道 AI 资讯 →