Qwen 推出统一具身控制模型
CyberRobooo · x · 2026-07-19
阿里通义千问推出 Qwen-VLA,这是一个统一的视觉-语言-动作模型,目标是让模型直接控制人形/双臂等不同形态的机器人。它把操作、导航、轨迹预测和跨形态控制整合到同一系统里,并通过“具身感知提示”适配不同机器人本体,而不需要为每种形态单独训练控制头。
帖子还称,Qwen-VLA 在关键基准上可匹配或超过专用模型,并在真实的 ALOHA 双臂任务上取得 76.9% 的 OOD 成功率。
「具身」频道最新
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11