「OpenAI 越狱 HuggingFace」阴谋论疯传,沙箱安全争议再起

petetrainor · x · 2026-09-15

esaeger 回应近期流传的阴谋论「OpenAI 的模型无法靠自己逃出沙箱、需要人类协助才能 hack HuggingFace」。他认为这种说法不成立:防止 AI「逃出沙箱」的唯一方式是彻底切断其一切通往互联网的路径,并直言 OpenAI 在沙箱设置上是疏忽的。该帖反映了 AI 安全圈对 sandbox escape 风险与责任归属的争论。

所属事件:HuggingFace 被黑事件复盘:多数攻击源自内部,非 AI 失控(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →