Meta 公开 Muse 漏洞赏金计划,详解个人 Agent 安全架构
shuchaobi · x · 2026-09-09
Meta 官方宣布:个人智能体 Muse 的私有漏洞赏金计划自开发早期就已运行,现在正式公开,并发布了按实际影响定赏金的赔付准则。同期发布 20 分钟长文《我们如何将安全内建于 Muse》,由 Meta 超级智能实验室 VP Tarek Sheasha 撰写。
Muse 于今日正式发布,是能真正代用户做事的个人 agent:后台运行、发起子 agent 集群、自建工具、自我编辑——也是 Meta 首次把收件箱、日历和 shell 交给一个无人值守的软件。
安全设计的核心假设是"agent 随时可能被攻击":
- 模型针对零样本 CLI 工具调用、长上下文、长轨迹指令遵循(内建 prompt injection 意识)、多 agent 协调训练;
- harness 运行在隔离沙箱 cell 中,看不到真实凭证;
- 所有与外界的交互经过一个 agent 无法覆盖的 Sentinel 审查层;
- 经过大量内部吃狗粮、agent 红队以及安全研究人员在私有漏赏计划中的真实对抗检验加固。
Meta 承认 Muse 仍会犯错,但预期安全系统会显著降低错误频率与破坏程度。
所属事件:Meta 为 Muse 智能体开出高额漏洞赏金(4 条相关)→
「编程与Agent」频道最新
- 用Astra做Catan游戏完成度惊人,还能复用过往UI与3D资产 — FinanceYF5 · 2026-09-11
- 曝 OpenAI Codex 或于本周末再发额度重置,Codex 负责人暗指常有 — umesh_ai · 2026-09-11
- Ceetrix 实测:gemini-3.5-flash-lite 效果平替 3.8,成本仅零头 — julianharris · 2026-09-11
- ComfyUI 风格浏览器更新:LoRA 预览目录与分享功能 — neonsparksuk · 2026-09-11
- 用户实测:Codex 单轮烧掉 4700 积分,$200 额度 20 分钟未完成任务 — RileyRalmuto · 2026-09-11
- 实测各 LLM 订阅真实代币价值:Grok Heavy 40 倍 ROI 最高 — thesaraharminta · 2026-09-11