Rhoda AI 实证:网络视频预训练越大,真机操作策略越强
stepjamUK · x · 2026-09-16
机器人公司 Rhoda AI 发文检验一个广泛流传但未被严格验证的信念:扩大网络视频预训练规模能否提升真实机器人任务表现。团队提出 Direct Video-Action 模型(DVA),改变预训练模型规模与算力预算,再用相同工业任务的机器人演示做后训练,在真实机械臂上评测。
核心发现(基于超 200 小时真机评估):
- 更大的预训练视频模型持续带来更好的机器人策略,且趋势在测试的最大规模下仍未饱和
- 增加预训练算力在所有机器人数据量下都有效,机器人数据越稀缺收益越大
- 预训练阶段对 held-out 网络视频的预测质量与最终真机策略表现跨规模、跨算力预算一致相关
结论支持把网络视频预训练规模化作为机器人基础模型的有效路线。
所属事件:Rhoda 千次实验证实网络视频预训练提升机器人性能(3 条相关)→
「具身」频道最新
- 机器人 GPT 会就是 GPT 本身:机器人专家实测通用模型操纵能力 — chris_j_paxton · 2026-09-16
- U-BOT 机器人 MuJoCo 航点跟踪仿真画面精致到像假 — _Stocko_ · 2026-09-16
- 人形机器人零样本导航复杂地形,全靠机载感知与计算 — chris_j_paxton · 2026-09-16
- 中国服装厂工人头戴相机记录缝纫,数据用于训练人形机器人 — mustafamhus · 2026-09-16
- 曝 Meta 今秋推出无摄像头版 Luna 智能眼镜 — Polymarket · 2026-09-16
- 前 Tesla Optimus 工程师离职:物理 AGI 仍待解视频模型与 scaling 难题 — mihdalal · 2026-09-16