用大模型监督小模型未来动作,自动驾驶早期 on-policy 蒸馏思路

abursuc · x · 2026-09-16

在 SSAD 2026 相关讨论中,研究者 abursuc 介绍了将 LLM 式「think-ahead」引入自动驾驶的思路:用大型教师模型监督小型学生模型的未来动作,细看可视为一种早期的 on-policy 蒸馏形式,应用于驾驶任务。

所属事件:SSAD 2026 探讨用大模型监督自动驾驶小模型(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →