自动驾驶视觉感知转向端到端,框标注局限凸显

传统视觉 ML 模型受限于标注框范围,在高速行驶场景下可能丢失关键信息,如 80 米外仅剩约 2 秒预警,无法捕捉细微差别,因此自动驾驶需要 200 米超长距标注方案(如 Aimotive 数据集)。MIT 教授 Bill Freeman 在 CVPR 演讲中也列出「苦涩教训」式经验,首条即指出训练端到端模型胜过一切其他方法,前沿机器人正抛弃框标注转向端到端。

2026-08-27 ~ 2026-08-27 · 2 条相关