RACE:让VLA机器人动作块延长4倍,停顿时间缩短约5倍

POSTECH · hf · 2026-10-06

RACE:VLA 模型的可靠动作块延长方案

VLA(视觉-语言-动作)模型作为机器人操作的统一策略,推理开销大,导致机器人在策略调用之间必须暂停,走走停停、动作不流畅、任务耗时延长。延长动作块可减少调用次数,但预测越远长块执行越不可靠。

POSTECH 团队分析长块内的动作误差,发现误差集中在操作子技能的切换处,且随块长急剧增长——关键在于切换时机。

RACE(Reliable Action-Chunk Extension)框架:用一次辅助的单步去噪 pass 预测切换时机,并以此为条件生成动作,从而降低子技能切换处的误差,可靠执行更长的动作块。

结果:

代码与真机演示:github.com/Seonghoon-Yu/RACE-VLA

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →