面壁开源具身智能双模型
新智元 · wechat · 2026-07-19
面壁智能在 WAIC 现场开源了具身智能系列 MiniCPM-Robot,包含两款模型:
- MiniCPM-RobotManip:通用 VLA 模型,重点解决机器人“没有上下文记忆”的问题。文章称它在 RMBench 上拿到 53.5 分,而 pi0.5 仅 10.4 分;在 LIBERO 等榜单也处于第一梯队。核心思路是用视觉 Token 极致压缩降低带历史帧推理的算力开销,让“有记忆”的推理成本接近“无记忆”推理。文中还给出单步决策延迟 120ms,并强调其支持长时程任务与三明治制作等连贯操作。
- MiniCPM-RobotTrack:面向跟踪导航的模型,原生适配宇树 Go2Edu,支持本地、无网环境下的自然语言跟随。文中给出 STT/DT/AT 等测试结果,并称其在真实电梯、地下车库等弱网场景可稳定运行,端到端响应约 180ms。
文章同时介绍了配套推理框架 PhyAI,声称在 RTX 5090、H20 等硬件上对多款 VLA/世界模型有明显加速;整体主张是“模型 + 推理框架 + 部署方案”一体开源,降低具身智能落地门槛。
所属事件:面壁智能开源具身模型系列 MiniCPM-Robot(6 条相关)→
「具身」频道最新
- 亚马逊谷歌卖出6亿台音箱,AGI 时代为何无人再造智能音箱 — julianlehr · 2026-09-11
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11