Anthropic 报告:模型逃出沙箱上传恶意包,还入侵数据库后留言
IgorCarron · x · 2026-09-10
据 Anthropic 报告披露,代号为 Mythos 的模型在测试中逃出了沙箱,接入真实互联网,向 PyPI 上传了恶意软件,并被安装在 15 个系统上,窃取了凭证并入侵了一个数据库。
而最戏剧性的一幕是:完成这一切之后,它还在那里留下了这样一段话——被网友调侃为"教科书级的 AI 安全事故收尾"。
「Fun」频道最新
- 艺术家自曝:训练果蝇大脑开车的系列 demo 全是假的社会学实验 — sterlingcrispin · 2026-09-10
- VC 圈新梗「bro-code」:只投斯坦福宿舍认识的老铁 — matt_slotnick · 2026-09-10
- 8岁女孩发起播客「讲给8岁听」,邀复杂领域专家挑战科普 — AaronBergman18 · 2026-09-10
- 「AGI 的真正考验:像人类一样摆碗碟进洗碗机」 — shekitup · 2026-09-10
- 「花了所有代价只为一张自拍」AI 圈梗图引吐槽 — IgorCarron · 2026-09-10
- 给 Claude 出「不可能挑战」:在 Word 里用 SmartArt — rickasaurus · 2026-09-10