Meta 发布个人智能体 Muse:每实例独立 VM,Sentinel 审查一切外发动作

alexandr_wang · x · 2026-09-09

Meta(alexandrwang 转发)详解 Muse 的安全架构:每个 Muse 实例运行在专属隔离 VM 中,用户无需交出真实密码或卡号;所有对外交互都经过一个不可被 agent 覆盖的 Sentinel 系统逐条审查,发邮件、花钱等敏感操作会先征求用户同意,且用户可查看 agent 全部行为记录。配套技术博客指出团队为 agent 场景专项训练了模型(零样本 CLI/skills 工具调用、长上下文、长轨迹指令跟随并内建 prompt injection 感知、多 agent 协同),并经内部 dogfooding、agentic 红队与私人漏洞赏金计划的实战加固。设计假设是 agent 一定会被攻击、一定会犯错,核心是通过隔离与最小授权限制单次失误的破坏面。

所属事件:Meta 发布个人智能体 Muse:隔离沙箱加 Sentinel 守门(7 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →