腾讯混元开源两款具身基座模型
机器之心 · wechat · 2026-07-15
腾讯 RoboticsX、福田实验室与腾讯混元联合推出两款具身基座模型:Hy-Embodied-VLM-1.0 和 Hy-Embodied-RxBrain-1.0,并已开源。
Hy-Embodied-VLM-1.0
- 聚焦具身智能中的 理解—行动—适应 闭环
- 覆盖物理状态理解、动作-变化推理、时序与自适应推理
- 基于最新混元 A3B 基座,经过大规模具身数据增训
- 在 37 个评测任务上,用约 1/10 计算量 达到上一代 A32B 旗舰具身模型相近效果
Hy-Embodied-RxBrain-1.0
- 统一建模 世界理解、推理规划、行动后果预测
- 结合文本推理与视觉想象,面向下游动作模型提供更密集的多模态条件
- 训练数据包括 5 万+小时 高质量具身数据,并构建约 2.1 亿 条训练样本
- 在 RxBrain-Bench 上,联合规划得分 0.68,高于若干对比系统
真机与基准
- 真机任务覆盖摆放餐具、折叠收纳眼镜、丢垃圾等多阶段操作
- 在 DOBOT X-Trainer 和方舟无限 A5 上,平均成功率 87%
- 作者强调:视觉想象不是“展示效果”,而是能被动作模型实际利用的中间认知表示
「具身」频道最新
- 亚马逊谷歌卖出6亿台音箱,AGI 时代为何无人再造智能音箱 — julianlehr · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11