SLIP-VLA:用单步预测潜变量替代迭代想象,VLA 策略学习更高效
zhenjun_zhao · x · 2026-09-30
新论文 SLIP-VLA 针对视觉-语言-动作(VLA)模型的策略学习提出改进:把原本需要迭代展开的「未来想象」(future imagination)替换为单步预测的潜变量表示,从而实现高效的未来感知动作预测。作者包括 Tianfu Li、Haoang Li、Hao Liu 等十余位研究者,论文链接见 arXiv。
「具身」频道最新
- YC 转发「智能体制造」基础设施:说出想法,机器人零件送上门 — ycombinator · 2026-09-30
- 人形机器人洗衣服 demo:被拔手改设置仍能回去续上任务 — JasonMa2020 · 2026-09-30
- Sentdex 给自研机器人征名,相中「chonk」 — Sentdex · 2026-09-30
- Waymo 体验揭示:旧金山每 20-30 单仍需远程员救场 — herbiebradley · 2026-09-30
- 机器人跳舞为何是好演示:平衡无处藏身,系统辨识的试金石 — chris_j_paxton · 2026-09-30
- 伯克利触觉压缩器将 10 指数据压缩至 2 个手部潜变量,训练提速 2.26 倍 — berkeley_ai · 2026-09-30