HuRo 数据集:63 万条人类视频机器人化样本,VLA 预训练完成率 51.5%→80.3%
RLWRLD · hf · 2026-09-22
RLWRLD 发布 HuRo 工作,系统性验证「机器人化人类视频」能否作为 VLA 预训练的可扩展监督来源。其 pipeline 把异构人类视频转成机器人对齐的观测与动作轨迹,并补全缺失的中间信号,构建出含约 63 万条机器人化 episode、1.42 亿帧的数据集(来自五个人类视频源)。在四个真实操作任务上:- 预训练数据增多使总体完成率从 51.5% 升至 80.3%
- 空间/视觉分布偏移下的 OOD 完成率从 34.9% 升至 72.2%
- 消融显示视觉机器人化提升 OOD 鲁棒性,端到端重定向动作预训练优于纯视觉迁移
「具身」频道最新
- Figure 发布 Helix 2.5,人形机器人零样本搞定 30 套陌生住宅 — FinanceYF5 · 2026-09-22
- Figure 发布 Helix 2.5,租 30 套住宅零样本测家务 — FinanceYF5 · 2026-09-22
- PrimeBOT T1 售价19999元起,产线每2.5分钟下线一台人形机器人 — davidpattersonx · 2026-09-22
- RoboDawn:用 VLM 加离散指令闭环控制机器人,零样本胜 π0.5 — Meng-Hao Guo · 2026-09-22
- Siemens 携手伯克利发布 ARLI:推理延迟下也能对 VLA 做 RL 微调 — svlevine · 2026-09-22
- 嫌弃 5 万美元商用转运车太贵,工程师自改扭扭车造 Robocart — uavbro · 2026-09-22