Wayve 研究员:机器人领域难现颠覆性目标函数,仍是下 token 预测变体

m_wulfmeier · x · 2026-09-15

mwulfmeier 参与近期关于「更好的训练目标」的讨论,从机器人数据效率角度表态:他不认为会出现与 next token likelihood 差异很大的更优目标函数。Multi token prediction、offline RL、inverse RL(本质上都是整条轨迹预测)都只是「预测未来某些 token」的加权变体;目前没有其他方法在计算便宜性和规模化鲁棒性上同时展现出令人信服的阶跃式改进。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →