RLHND:用视频扩散模型同时追踪手部姿态与触觉,助力机器人学习

RLWRLD · hf · 2026-10-08

RLHND 提出将预训练视频基础模型(Cosmos 3 视频扩散骨干)改造为确定性片段级特征提取器,从单目第一人称视频联合估计手部姿态与触觉信息,用于机器人策略训练。

核心要点:

代码将开源。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →