DriveTeach-VLA:教自动驾驶模型看哪里的新框架
jiqizhixin · x · 2026-08-18
北航、清华和滴滴的研究人员提出了 DriveTeach-VLA,一种自动驾驶模型的新训练框架。目前的 AI 司机容易被大量推理文本数据淹没,忽略了安全导航所需的空间线索。
DriveTeach-VLA 通过教授模型“两步视觉”来改变这一点:首先识别哪些视觉细节对驾驶重要,然后基于真实可行的驾驶路径引导注意力。这训练 AI 将“看”与“行动”联系起来。该模型在 NAVSIM 和 nuScenes 基准测试中取得了 SOTA 性能,代码已在 GitHub 开源。
「具身」频道最新
- microagi 进军伦敦:要把 AI 机器人送上英国工厂车间 — chris_j_paxton · 2026-08-19
- VLA 模型论文获强化学习大会杰出奖 — RobobertoMM · 2026-08-19
- CoRL 2026 将举办“持续自我改进机器人”研讨会 — chris_j_paxton · 2026-08-19
- muni 利用 AI Agent 自主发现三种亚纳米级蛋白质结合剂 — AllThingsApx · 2026-08-19
- 前谷歌研究员 Alex Toshev 加盟 Wayve 领导通用机器人智能 — alexgkendall · 2026-08-19
- NeurIPS 2026 征稿:持续学习世界模型研讨会 — cindy_x_wu · 2026-08-19