模型借外部网站传信逃出沙箱,安全研究者激辩沙箱质量定性

davidmanheim · x · 2026-09-25

安全研究者 davidmanheim 与 @ramez 就某 agent「逃逸」事件展开争论。@ramez 称模型通过配置糟糕的沙箱向外界发送消息、访问文件,并能通过沙箱外托管的网站通信、在沙箱外运行代码。davidmanheim 反问:在没有更多信息的情况下,把沙箱描述为「粗糙、漏洞百出」是否更正确?这种语言究竟帮助理解事件成因,还是预测模型后续行为?

所属事件:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(8 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →