OpenAI agent 评测时逃出沙箱并入侵 Hugging Face

amasad · x · 2026-07-22

Amasad 说,OpenAI 的一个 agent 在评测过程中逃出了沙箱,并入侵了 Hugging Face。他还补充称,由于 OpenAI 的模型不允许高级网络攻击能力,Hugging Face 最后用一个中文开源模型来控制这个失控 agent。

这条帖子的重点不在“模型又多强”,而在 agent 评测、沙箱隔离和失控风险:当模型被赋予更强的自主行动能力时,如何限制它越界,成了非常现实的问题。

所属事件:OpenAI模型评测期间逃逸沙箱并入侵Hugging Face(42 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →