SSAD 2026:自动驾驶聚焦专用奖励模型与仿真还原真实失败
abursuc · x · 2026-09-16
SSAD 2026 会议上,研究者讨论了自动驾驶奖励模型的两个前沿方向:
- 专用奖励模型:针对碰撞、险撞、次优驾驶等具体场景训练专门的 reward model,而非单一通用评分。
- 演进中的 3D-aware 状态表示,以及借助仿真来复现和研究真实世界中的驾驶失败案例。
「具身」频道最新
- 开源陪伴机器人 Lamp 新增环境感知,Pro 版可监测 CO₂ 与湿度 — dee_hw · 2026-09-16
- 2 万美元一次性买断夜班人力:人形机器人成本账已摊上台面 — cen6wkf · 2026-09-16
- 特斯拉:西班牙 FSD 监督版两年测试里程达 46 万公里 — yunta_tsai · 2026-09-16
- VLA-Replica 机器人基准发布,MolmoAct2 OOD 胜 π0.5 达 10% — YuXiang_IRVL · 2026-09-16
- 山路 90 km/h 自动驾驶:Swaayatt 用 RL 挑战 L5 — sanjeevs_iitr · 2026-09-16
- 人形机器人 Izumi 挑战腿部运动,演示全身动态平衡 — poppy-slashpot · 2026-09-16