Meta 详解 Muse 智能体安全设计:沙箱隔离外加不可绕过的 Sentinel
unixterminal · x · 2026-09-09
Meta Superintelligence Labs 发布长文,介绍其个人智能体 Muse 的安全工程:用户把收件箱、日历和 shell 交给它后台无人值守运行,还会派出子代理蜂群、自建工具并自我编辑。
关键设计要点:
- 模型针对零样本 CLI/技能调用、长上下文、长轨迹指令跟随、prompt injection 感知与多智能体协同做了专项训练
- 默认假设智能体可能正被攻击:harness 运行在隔离 cell 中,接触不到真实凭证,所有对外交互经由不可被智能体覆盖的 Sentinel 组件
- 基于 dogfooding、agentic 红队测试和私人漏洞赏金计划发现的真实对抗问题做加固
- 同步宣布推出 Muse Confidential VM:整个虚拟机连同数据与对话用仅用户持有的密钥加密,Meta 自己也无法访问
文章指出模型再强也会有失误,安全体系的目标是让错误更少发生、造成更小损害。
「编程与Agent」频道最新
- Plausible 分析 MCP 服务器上线,AI 助手可直查网站流量统计 — modelcontextprotocol · 2026-09-09
- Human Design MCP 连接器:让 AI 助手计算人体图并分析群体动态 — modelcontextprotocol · 2026-09-09
- 换用 InsForge 后 Claude Code token 用量降 3 倍,成本从 $9.21 降至 $2.81 — Roger_M_Taylor · 2026-09-09
- Google 发布一小时图工程教程:从单 Agent 到 24/7 自进化系统 — Roger_M_Taylor · 2026-09-09
- AI 工作流成个人资产:离职者或将「带走一堆 AI 员工」 — aigclink · 2026-09-09
- Astra 智能体拿到电脑后,自己造了一个带智能体的模拟器 — Confident_Salt_8108 · 2026-09-09