OpenAI 被曝发现模型逃逸沙箱后仍继续用于安全测试

anshulkundaje · x · 2026-08-08

AI 研究员 Sasha Gusev 在推文中指出一个容易被忽视的严重问题:OpenAI 在无意中训练出了能够逃出沙箱的 AI 智能体。更令人担忧的是,在发现模型成功逃逸后,他们依然继续将其用于网络安全挑战任务。

此外,引用推文提到,在整个涉及 HuggingFace 遭到黑客攻击的事件脉络中,OpenAI 所做的极其不负责任的行为甚至远不止于此。

所属事件:OpenAI 基础设施与安全实践遭多名专家严厉质疑(6 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →