VLA 泛化差或因指令太短,学者称大数据需强条件化配对

YouJiacheng · x · 2026-10-11

YouJiacheng 引用 Alignment 2026 会上观点指出:VLA 泛化差的一个可能原因是数据呈现方式——模型被训练去把简短文本指令映射到冗长复杂轨迹,指令信息量不足以解释轨迹,导致模型过拟合环境细节而非指令本身。他建议改用更丰富、描述任务实际执行方式的文本指令,并类比图像/视频生成:核心生成模型同样依赖越来越详细的 prompt,而把用户短请求扩写成详细 prompt 的环节应由模型承担。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →