TurboVLA 模型重构推理路径,消费级显卡实现高频机器人控制
针对现有视觉-语言-动作(VLA)模型高度依赖大语言模型导致计算与内存开销过大的痛点,研究团队提出了 TurboVLA 模型。该模型将传统的“视觉到语言再到动作”路径重构为直接的动作解码路径。凭借仅 0.2B 的参数量,TurboVLA 成功在 RTX 4090 等消费级显卡上实现了 32Hz 的高频机器人实时推理与控制,大幅降低了硬件门槛。
2026-07-30 ~ 2026-07-31 · 2 条相关
- TurboVLA:消费级显卡实现 32Hz 机器人实时控制 — H-EmbodVis · 2026-07-30
另有 1 条近重复转述:_akhaliq