Meta 公开 Muse 个人智能体安全架构:Sentinel 拦截与人在环审批
altryne · x · 2026-09-11
Meta 发布长文详解其个人智能体 Muse 的安全设计。Muse 可接管邮箱、日历和 shell 无人值守运行,还能派出子智能体蜂群、自建工具。为防失控,团队假设智能体随时可能被攻击:运行在隔离沙箱中、看不到真实凭证,所有对外交互都经过一个不可被智能体覆盖的 Sentinel。
安全机制延伸到 HTTP/HTTPS 之外的 TCP/UDP 协议:开启某协议后,Muse 会弹出包含主机名和端口的「人在环」审批卡片,用户可精细控制权限。模型针对零样本工具调用、长上下文、长轨迹指令跟随与 prompt injection 内建感知做了专项训练,并经过 agentic 红队测试和私有漏洞赏金计划加固。
所属事件:Meta 公开 Muse 智能体安全架构获好评(2 条相关)→
「编程与Agent」频道最新
- 马斯克转曝:SpaceXAI 团队下周直播用 Grok 从零建一家公司 — elonmusk · 2026-09-11
- 开发者用 Astra 打造远程调试器,局域网内操控另一台电脑 — ___Patrice___ · 2026-09-11
- 实测观察:模型在长时编排多子智能体时仍表现吃力 — gabriel1 · 2026-09-11
- 老手建议:清空 Claude Code 全部旧配置,效果胜过换新模型 — tetsuoai · 2026-09-11
- 一年前 agent 自主跑 10-20 分钟还是妄想,现在早已不是 — julianharris · 2026-09-11
- Girder 0.2.5 发布:代码图谱让 agent 按需取函数,97% 解析复用 — AdSuccessful1178 · 2026-09-11