SeerGuard 用世界模型提前拦截移动 GUI Agent 风险动作
Xue Yu · hf · 2026-07-22
- 论文提出 SeerGuard,这是一个面向移动 GUI agent 的“后果感知”安全框架。
- 它把 执行前指令筛查 和 动作级风险评估 结合起来,尽量在 agent 真正点击/操作前预测后果。
- 作者还通过多任务学习构建了统一的 安全增强世界模型(SAWM),把下一状态预测和安全风险评估合在一起训练。
- 在 Qwen3-VL-8B-Instruct 上,ω=0.8 时 safety-utility score 从 0.191 提升到 0.596;α=0.8 时 risk-cost score 从 0.347 降到 0.130。
- 论文强调,这套方法能泛化到多种移动 GUI agent,且指令筛查与动作风险预测都对效果有贡献。
「编程与Agent」频道最新
- Salesforce 说企业智能体正从循环走向图式路由 — msrivastav13 · 2026-07-22
- AI agent 接支付怎么测?开发者在问假身份与 KYC — Friendly-Tear990 · 2026-07-22
- 作者称该默认用小型子代理团队分工 — alex_teichman · 2026-07-22
- Cursor 团队用 Cursor 开发 Cursor 的自指演示 — soleio · 2026-07-22
- NVIDIA 演示 Unreal 通过 MCP 接入 Claude Code 和 Cursor — nptacek · 2026-07-22
- 本地 AI agent 现可持久识别并跨设备互发消息 — IngenuityClean8280 · 2026-07-22