从人类视频到机器人:零样本奖励模型的早期探索

JasonMa2020 · x · 2026-08-13

作者回顾了将人类视频训练的奖励模型零样本迁移到机器人上的早期研究,指出该思路在当今标准下虽已显得古老,但奠定了基础。

所属事件:人类视频数据显著提升机器人泛化能力(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →