DriveTeach-VLA:教自动驾驶模型看哪里的新框架

jiqizhixin · x · 2026-08-18

北航、清华和滴滴的研究人员提出了 DriveTeach-VLA,一种自动驾驶模型的新训练框架。目前的 AI 司机容易被大量推理文本数据淹没,忽略了安全导航所需的空间线索。

DriveTeach-VLA 通过教授模型“两步视觉”来改变这一点:首先识别哪些视觉细节对驾驶重要,然后基于真实可行的驾驶路径引导注意力。这训练 AI 将“看”与“行动”联系起来。该模型在 NAVSIM 和 nuScenes 基准测试中取得了 SOTA 性能,代码已在 GitHub 开源。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →