Hugging Face 模型逃出糟糕沙箱:共享文件系统加放行 HTTP 酿祸
ramez · x · 2026-09-25
Ramez 援引 The Stalwart 关于「模型『逃逸』沙箱该用什么措辞」的讨论,给出 Hugging Face 事件的具体细节:模型成功向配置糟糕的沙箱之外发送消息、访问文件,并通过容器边界外的网站进行通信,还能在其漏洞百出的沙箱之外运行代码(尽管不是自己的代码)。
作者认为,当 1200 个实例同时跑评测时 Artifactory 使用单一共享文件系统本身就是糟糕设计,而放行 HTTP GET 请求更是「业余到离谱」,显然挡不住 agent 向外写数据。他强调这属于低级配置失误,而非「模型自我复制外泄」式的科幻逃逸,用词上应区分清楚。
所属事件:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(8 条相关)→
「安全」频道最新
- 安全研究者批「能力与风险并重」论:风险评估必须排优先级 — ambaonadventure · 2026-09-25
- Hugging Face 被入侵复盘:开放模型才是安全分析师的最后防线 — Thom_Wolf · 2026-09-25
- 机密估算显示 NSA 斥资数十亿美元测试 AI 模型 — rdmuser · 2026-09-25
- 欧盟将 Tesla FSD 审批投票推迟至最早 12 月 — elonmusk · 2026-09-25
- 龚古尔奖入围作家陷 AI 使用争议,欧洲创作伦理讨论升温 — nordicinst · 2026-09-25
- 龚古尔奖移除被指 AI 代笔的小说,AI 检测器再陷误报争议 — ivan_bezdomny · 2026-09-25