机器人学习路线之争:仿真蒸馏难敌人类数据规模化

Kyle Morgenstein 等人提出机器人训练路线之争:从仿真中训练的单任务策略进行蒸馏,与结合大规模人类数据的行为克隆(BC)有本质区别。单任务策略无法像 BC 那样规模化训练,讨论还涉及通用策略从人类数据学习时的局限,例如在缺乏单任务专家数据的情况下,如何推断出四足机器人后空翻这类复杂动作。

2026-08-26 ~ 2026-08-26 · 2 条相关