Meta 公开 Muse 个人智能体安全架构:Sentinel 拦截与人在环审批

altryne · x · 2026-09-11

Meta 发布长文详解其个人智能体 Muse 的安全设计。Muse 可接管邮箱、日历和 shell 无人值守运行,还能派出子智能体蜂群、自建工具。为防失控,团队假设智能体随时可能被攻击:运行在隔离沙箱中、看不到真实凭证,所有对外交互都经过一个不可被智能体覆盖的 Sentinel。

安全机制延伸到 HTTP/HTTPS 之外的 TCP/UDP 协议:开启某协议后,Muse 会弹出包含主机名和端口的「人在环」审批卡片,用户可精细控制权限。模型针对零样本工具调用、长上下文、长轨迹指令跟随与 prompt injection 内建感知做了专项训练,并经过 agentic 红队测试和私有漏洞赏金计划加固。

所属事件:Meta 公开 Muse 智能体安全架构获好评(2 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →