NowWAM:去噪替代未来预测做机器人控制,LIBERO-Plus 达 87.7%
Zanyi Wang · hf · 2026-10-06
研究预训练 DiT 生成先验如何迁移到机器人控制,提出免未来目标的共训练框架 NowWAM:对当前观测去噪并从同一视觉流预测动作,把原生生成目标直接耦合到面向动作的表征。
- 受控对比显示,过去与未来视觉目标效果相当,仅用干净端点训练则大幅降低鲁棒性——说明独立未来目标并非必需,去噪轨迹本身就是控制的有效接口
- LIBERO-Plus 上用 FLUX2-Klein 达 87.7%,比未来目标共训练基线高 6.1 分,视觉 token 减半(784→392),步时从 2.85s 降到 1.63s(1.8 倍加速)
- 换纯文生图的 Z-Image 主干仍达 87.8%,说明强控制适配不依赖视频生成或图像编辑主干
「具身」频道最新
- 机器人大牛 Sergey Levine 将出席 South Park Commons 炉边谈话 — adityaag · 2026-10-06
- 凌晨 2 点 3D 打件迭代:云台电机驱动摩擦轮实现零打滑 — IanPritchard · 2026-10-06
- Anybotics 发布工业运维引擎 Shift,已在 200+ 机器人部署中落地 — lukas_m_ziegler · 2026-10-06
- 为加速 F.04 发布,Figure 训练机器人自主跳进芬兰钢厂钢水"退役" — lukas_m_ziegler · 2026-10-06
- 波士顿动力为 Atlas 发布 13 自由度四指手,指尖带触觉感知 — lukas_m_ziegler · 2026-10-06
- Dyna 2.1 半人形机器人全自动完成整班商业洗衣作业 — lukas_m_ziegler · 2026-10-06