Dyna-2百万小时数据背后:Maxinsights成硅谷机器人「供血商」
新智元 · wechat · 2026-09-11
一家隐形的机器人数据基础设施公司浮出水面
Google DeepMind、Figure、1X、Genesis AI、Dyna Robotics等头部机器人玩家的背后数据供应商是Maxinsights——一家扎根硅谷的Physical AI团队,累计交付超200万小时第一人称数据,库存150万小时带手部追踪和语言标注的数据,月采集产能45万小时。
第一人称数据为何重要
机器人领域缺一个「人类动作的互联网」:互联网有海量视频,却没有「手的视角」记录人怎么干活。相比昂贵且绑定本体(robot embodiment)的遥操作数据,第一人称数据让人类日常经验进入训练系统。Dyna-2用100万小时人类第一人称视频预训练,模型性能跨越四个数量级单调提升,未见天花板;GENE-26.5靠第一人称数据加手套传感器,仅用不到一小时机器人专属数据即实现20步做饭自主执行。
算法三层能力
- 姿态追踪:自研MaxEgo在手部遮挡、双手交叉、动作模糊时仍能稳定追踪,MaxEgo 0.5到1.0难例关键误差下降超一半,底座是20亿帧人体姿态数据。
- 空间定位(SLAM):人绕一圈回来轨迹仍能闭合对齐,让动作有完整空间背景。
- 语义标注:自研视频理解模型按「环境→任务→子任务→动作」分层组织。
运营飞轮
全球5000+采集员(主妇、厨师、工人、农民),Agent平台调度数据分布、识别摆拍、每两周轮换场景。四阶段自动化QA让98%质检由机器完成,人工纠正样本回流训练。团队来自Waymo、谷歌、Meta及斯坦福、伯克利。公司观点:Physical AI的Scaling Law同时也是一条Manufacturing Law——四道关口各95%良率端到端只剩81%;下一步考题是Experience Density(每新增一小时是否带来新物理经验)。
「具身」频道最新
- 机器人 Reachy Mini 被纳入 NVIDIA 组合后不再低调 — RachelVT42 · 2026-09-11
- UMO 统一框架解锁动作基础模型先验,横扫多种人形动作任务 — Michael_J_Black · 2026-09-11
- 南洋理工系初创 Ropedia 融资 3000 万美元,用可穿戴设备给机器人喂数据 — liuziwei7 · 2026-09-11
- 机器人圈为何对 AGI 集体沉默:能洗碗洗衣再说 — MannyKayy · 2026-09-11
- 实拍中国光电展:XR 供应链上游供应商全景速览 — Scobleizer · 2026-09-11
- 无方向盘无踏板:特斯拉 Cybercab 无人出租车首次亮相日本 — yunta_tsai · 2026-09-11