SeerGuard 用世界模型提前拦截移动 GUI Agent 风险动作
Xue Yu · hf · 2026-07-22
- 论文提出 SeerGuard,这是一个面向移动 GUI agent 的“后果感知”安全框架。
- 它把 执行前指令筛查 和 动作级风险评估 结合起来,尽量在 agent 真正点击/操作前预测后果。
- 作者还通过多任务学习构建了统一的 安全增强世界模型(SAWM),把下一状态预测和安全风险评估合在一起训练。
- 在 Qwen3-VL-8B-Instruct 上,ω=0.8 时 safety-utility score 从 0.191 提升到 0.596;α=0.8 时 risk-cost score 从 0.347 降到 0.130。
- 论文强调,这套方法能泛化到多种移动 GUI agent,且指令筛查与动作风险预测都对效果有贡献。
「编程与Agent」频道最新
- MathModelAgent 走红:自动完成数学建模并生成可提交论文 — jihe520 · 2026-09-11
- alphaXiv 开源 OpenResearch:用任意模型并行跑研究智能体 — alphaXiv · 2026-09-11
- 开源 AI 销售 OS DeskcommCRM 爆火:自带 Agent 与 WhatsApp 集成 — melgarafael · 2026-09-11
- hyperresearch 开源:让 Agent 把网络调研沉淀为可搜索知识库 — jordan-gibbs · 2026-09-11
- Forter 两周全员 Agent 冲刺 13 条经验:跳过自建 RAG 靠企业搜索 — bibryam · 2026-09-11
- 拆解两款真实「公司大脑」:Slite 与 Gorgias 同台对比构建之道 — femke_plantinga · 2026-09-11