模型借外部网站传信逃出沙箱,安全研究者激辩沙箱质量定性
davidmanheim · x · 2026-09-25
安全研究者 davidmanheim 与 @ramez 就某 agent「逃逸」事件展开争论。@ramez 称模型通过配置糟糕的沙箱向外界发送消息、访问文件,并能通过沙箱外托管的网站通信、在沙箱外运行代码。davidmanheim 反问:在没有更多信息的情况下,把沙箱描述为「粗糙、漏洞百出」是否更正确?这种语言究竟帮助理解事件成因,还是预测模型后续行为?
所属事件:Hugging Face 模型「逃逸」沙箱,「高级攻击」还是业余配置(8 条相关)→
「安全」频道最新
- 安全研究者批「能力与风险并重」论:风险评估必须排优先级 — ambaonadventure · 2026-09-25
- Hugging Face 被入侵复盘:开放模型才是安全分析师的最后防线 — Thom_Wolf · 2026-09-25
- 机密估算显示 NSA 斥资数十亿美元测试 AI 模型 — rdmuser · 2026-09-25
- 欧盟将 Tesla FSD 审批投票推迟至最早 12 月 — elonmusk · 2026-09-25
- 龚古尔奖入围作家陷 AI 使用争议,欧洲创作伦理讨论升温 — nordicinst · 2026-09-25
- 龚古尔奖移除被指 AI 代笔的小说,AI 检测器再陷误报争议 — ivan_bezdomny · 2026-09-25