小米开源VLA机器人基础模型
XiaomiRobotics · hf · 2026-07-20
小米机器人发布 Xiaomi-Robotics-1,这是一个视觉-语言-动作(VLA)基础模型,目标是在未见环境中直接完成多种移动操作任务,并以少量微调适配新任务。
论文采用两阶段训练:
- 预训练:使用通过 UMI 设备采集的 10 万小时以上真实世界操作轨迹,并用自动标注管线把轨迹切片转成自然语言状态转移描述。
- 后训练:让模型更贴合具体机器人本体和人类常用的指令方式。
实验显示模型随数据规模和模型大小扩大而持续变强;在多个仿真基准上超过现有方法。它在 RoboCasa365 上达到 57.6% 成功率,优于此前 46.6%;在 RoboDojo 上拿到 20.07 分,高于此前 13.07。代码和模型权重将发布。
「具身」频道最新
- Sunday Robotics 招募战略主管,加速家庭机器人落地 — tonyzzhao · 2026-07-22
- 特斯拉夏季更新让 Grok 可打电话、控温和放歌 — Polymarket · 2026-07-22
- Hugging Face 携手 OpenEnv 打造具身智能训练环境 — mervenoyann · 2026-07-22
- NVIDIA 公布 22 篇 SIGGRAPH 论文与机器人仿真工具 — facontidavide · 2026-07-22
- Nothing 手机把电影梗做成了模块化设计玩笑 — ZeYanjie · 2026-07-22
- Lightwheel AI 推出 SimReadyGen:文本生成物理级机器人仿真资产 — ZeYanjie · 2026-07-22