机器人策略用 4 小时离域数据,反超同域数据表现
DominiqueCAPaul · x · 2026-07-27
作者分享了一个意外的机器人训练结果:在 lightbox 评测里,用来自 5 张桌子、2 个工作站 的 4 小时 多样化数据训练出的策略,竟然打败了同样时长、但数据全部来自 lightbox 内部的策略。
核心结论是:多样化的离域数据,反而在同域评测上赢过同域数据。作者说自己原本以为超参数会带来更大差异,但实际影响更大的,是数据采集方式。
「具身」频道最新
- 高通机器人在演示中途突然倒下,现场翻车 — iamfakhrealam · 2026-07-27
- 烹饪机器人公司智谷天厨再融资近亿元 — 创业邦 · 2026-07-27
- Apollo Go 在香港启动首次全无人驾驶试运营 — Baidu_Inc · 2026-07-27
- WorldDreamerV4瞄准机器人群体共享世界模型,拿下RoboCasa和WorldScore第一 — 机器之心 · 2026-07-27
- WAM 综述称机器人正从反应式控制走向结果预测 — rohanpaul_ai · 2026-07-27
- AheadForm 在上海 WAIC 2026 展示超拟真人形机器人 — Olivier__OG · 2026-07-27