ECCV 论文:预训练 ViT 每 patch 一个标量即可驱动真实世界导航
chriswolfvision · x · 2026-09-12
Christian Wolf 团队在 ECCV 展示一项真实机器人导航研究:从异构多教师蒸馏的预训练视觉编码器中,每个 patch 仅提取一个标量特征,即可支撑真实建筑中的高速移动导航。
方法要点:
- 视觉编码器由异构教师蒸馏,获得互补技能
- 用注意力投影做空间瓶颈,涌现出与 affordance 相关的可解释特征
- 策略先用带特权信息的 Lidar 输入预训练,再去掉 Lidar 只用 RGB
这是一项 24 公里、966 个真实导航 episode 的大规模评测(见后续帖子)。
所属事件:ECCV 研究:每 patch 一个标量即可驱动机器人真实导航(2 条相关)→
「具身」频道最新
- 中国飞行人形机器人30层高空装空调,远程操控替代绳索工人 — TansuYegen · 2026-09-12
- 11 年人形机器人进化史:从摔倒到跑步踢球 — TinfoilTricorn · 2026-09-12
- 破壳机器人 CTO:一年内家庭任务 80% 零样本泛化 — suchenzang · 2026-09-12
- 曝 GPT-6 Astra 采用循环深度潜空间推理,安全专家忧推理不可监控 — DJiafei · 2026-09-12
- 机器人搬运 50kg 米袋不解开挂钩,「愚蠢」该如何度量? — ducha_aiki · 2026-09-12
- 德国创企 Magnotherm 磁制冷冰箱商用,比传统省电 15% — skdh · 2026-09-12