用大模型监督小模型未来动作,自动驾驶早期 on-policy 蒸馏思路
abursuc · x · 2026-09-16
在 SSAD 2026 相关讨论中,研究者 abursuc 介绍了将 LLM 式「think-ahead」引入自动驾驶的思路:用大型教师模型监督小型学生模型的未来动作,细看可视为一种早期的 on-policy 蒸馏形式,应用于驾驶任务。
所属事件:SSAD 2026 探讨用大模型监督自动驾驶小模型(3 条相关)→
「研究」频道最新
- 牛津论文《Theory Is All You Need》论证:LLM 数学上无法发明任何东西 — alex_verem · 2026-09-17
- PyTorch 大会将展示跨 7 国 9 数据集的联邦学习青光眼影像研究 — PyTorch · 2026-09-17
- 上下文裁剪省60% token却让任务成功率跌到77%,协议感知裁剪保住96% — dair_ai · 2026-09-16
- arXiv 新论文提出 Intelligence per Watt:量化本地 AI 的智能能效 — yogthos · 2026-09-16
- 开发者拆解 X 搜索排序架构:双塔检索 + L1/L2 多级排序 — _jaydeepkarale · 2026-09-16
- LinkedIn 用 LLM 解决关键词检索失败:内容价值只看两点 — _jaydeepkarale · 2026-09-16