讯飞系机器人新公司押注世界模型与本体认知
量子位 · wechat · 2026-07-23
量子位这篇长文围绕讯飞新成立的机器人公司,讨论具身智能真正的瓶颈到底在哪里。文章给出的判断很明确:不是身体不够强,而是“大脑”还没过实用门槛。
文中重点介绍了新方案的几个思路:一是认为 VLA 不是终局,在视觉—语言—动作之外加入视频生成模块,用来预测未来状态;二是把逆运动学做成训练任务,让模型学会“认识自己的身体能做什么”;三是把理解、预测、动作三个模块做成实时协同的结构,而不是传统的串行流水线。
在数据上,文章称他们把近一半训练资源放在空间推理、定位、物体指向和任务规划等“具身大脑数据”上,而不是单纯依赖真机轨迹。文中还给出了 LIBERO-Plus、RoboTwin 2.0 等基准上的高分表现,并提到讯飞相关机器人业务已经有真机落地基础。
「具身」频道最新
- ECCV26 口头论文:流匹配实现多视角点云配准 — ducha_aiki · 2026-09-11
- 波兰开发者做 iPhone 应用 可探测附近的 Meta 智能眼镜 — Low-Honeydew6483 · 2026-09-11
- 蚂蚁阿福用户达 1.5 亿,外滩大会展示 AI+硬件健康管理联盟 — APPSO · 2026-09-11
- JHU 开设全栈机器人学习课:组装机械臂、采数训练部署一条龙 — _krishna_murthy · 2026-09-11
- SyncWorld:少量视觉校准即可零样本模拟机器人跨视角交互 — ChongZzZhang · 2026-09-11
- 狗类 3D 姿态数据集发布,动物动捕研究可用 — ducha_aiki · 2026-09-11