Proxy Policy Steering:不动权重、用残差引导 VLA 学新任务
weichiuma · x · 2026-09-14
Kuan Fang 团队提出 Proxy Policy Steering(PPS),一种在推理阶段对 VLA(视觉-语言-动作)模型做任务特化的方法,全程无需访问或修改基座模型权重。
- 不采用直接微调,而是训练两个轻量级 proxy 策略
- 用两个 proxy 策略在速度空间(velocity-space)的残差来引导冻结的基座模型行为,实现新任务适配
这类方法的意义在于:大 VLA 基座可以保持冻结,通过外挂轻量模块快速适配新任务,降低定制成本。
「具身」频道最新
- 看机器人 demo 别只看成功:换光照换环境再数失败次数 — paigeinsf · 2026-09-14
- 机器鸭 MicroDuck 学会爬梯,行走只是起点 — econoar · 2026-09-14
- 特斯拉中国宣布 9 月 17 日起在上海北京展出 Cybercab — yunta_tsai · 2026-09-14
- MIT HardFlow 算法让生成模型零违规满足硬约束 — MIT News AI · 2026-09-14
- MIT 系公司用 AI 机器人把废塑料造成建材,桁架承重超 4000 磅 — MIT News AI · 2026-09-14
- 优必选万台级人形机器人工厂投产,蔚山AI数据中心扩至900兆瓦 — 创业邦 · 2026-09-14