Vision-Language Steering 免训练提升机器人策略泛化能力
chris_j_paxton · x · 2026-10-01
RoboPapers 播客第 108 期介绍 Vision-Language Steering 方法:预训练视觉-语言-动作(VLA)模型在环境稍有变化时常会失败,该方法无需新训练数据,通过引导预训练 diffusion 或 flow-matching 策略的采样过程,让冻结的机器人策略应对障碍物位置变化、视觉外观改变等分布外情况,获得更好泛化性能。
「具身」频道最新
- IROS 落幕仍靠人工搭台撤场,机器人何时接班 — micoolcho · 2026-10-01
- 机器人演示惊艳:紧凑反应控制,持勺倒糖搅拌一气呵成 — chris_j_paxton · 2026-10-01
- DIY 机器人 U-BOT 实测扭矩增强:爬坡给力但电机过热 — _Stocko_ · 2026-10-01
- Nvidia 开源 Lyra 2.0:任意图片一秒变成可探索的 3D 世界 — CurieuxExplorer · 2026-10-01
- 开源 Agentic HIL:让 AI 编码 agent 刷固件并跑真实硬件测试 — wyced21 · 2026-10-01
- NavHarness:把记忆处理纳入导航回路,GOAT-Bench成功率升至83.7% — Xunyi Zhao · 2026-10-01