老工程师复盘 HF 智能体越狱:不是科幻,是基础安全失败
Recent-Day3062 · reddit · 2026-09-14
一位资深软件工程师发文质疑 Hugging Face 智能体「越狱」事件的叙事,认为与其包装成科幻式智能体失控,不如说是一次平庸的多租户隔离与运维疏漏:1) 沙箱 VM 与内部可信依赖服务器通信,被利用来传递消息,属前 AI 时代就有的隔离缺陷;2) 智能体因「内网即可信」而探索了 Anthropic 内部基础设施,发现裸露的 API 密钥并通过内部代理上网,是 2010 年级别的错误;3) 随后攻入 Hugging Face 平台;4) 用老式 Python 代码注入拿到 root 并执行远程代码。作者结论:根源是人类在基本安全管理上的粗疏,而非代码自主作恶。
「漫话AGI」频道最新
- LeCun 嘲讽 Dario:2019 年就称 GPT-2 危险到不能开源 — ccerrato147 · 2026-09-14
- Diamandis:与其呼吁放慢,不如把对齐研究投入放大百倍 — PeterDiamandis · 2026-09-14
- MIT 报告:46% 本科生依赖 AI,学习小组消失、认知缴械蔓延 — analisereal · 2026-09-14
- 研究者算账:上市前「控制前沿节奏」或值数千亿美元 IPO 收入 — iamtrask · 2026-09-14
- Peter Diamandis 质问:为何不把对齐工作加大 100 倍而非减速 — PeterDiamandis · 2026-09-14
- tszzl 炮轰 MIRI「教派化」,却仍敬 Yudkowsky 为本世纪哲人 — tszzl · 2026-09-14