华科联合华为推TurboVLA:绕开LLM实现32Hz高频机器人控制

机器之心 · wechat · 2026-08-03

现有视觉-语言-动作(VLA)模型通常将大语言模型(LLM)作为视觉到动作的中间接口,导致计算开销大、动作延迟高。针对这一问题,华中科技大学联合华为提出了实时视觉-语言-动作模型 TurboVLA。

核心架构创新

TurboVLA 做了“减法”,绕开了 LLM 这一中间接口,采用更直接的 V+L→A 路径:

性能与效率优势

该研究证明,在明确的机器人操作任务中,动作预测未必每次都需要重新运行 LLM。未来由 LLM 负责高层规划、TurboVLA 负责低延迟执行的分层系统,将是更高效的技术路线。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →