机器人策略元数据条件化实验失败:文本提示被完全忽略

DominiqueCAPaul · x · 2026-09-30

作者尝试复现 physicalint 在 π0.7 模型上给文本提示附加元数据(episode/action chunk 信息)的做法,用速度作为条件变量:数据集包含两次录制,其中一次速度是另一次的两倍,在 prompt 后加后缀「speed: fast|slow」。

结果:策略完全忽略文本提示,切换 fast/slow 行为毫无变化。

进一步分析发现,速度信息其实已能从图像本身提取——一个逻辑回归模型在 99.8% 的留出帧上就能区分两次录制。肉眼可见的唯一差异只是桌上盒子和托盘的摆放位置略有不同,但已足够让模型区分。

结论/教训:如果条件信息已隐含在观测图像中,额外的元数据条件化可能被策略忽略,做此类实验前应先检查数据本身是否已泄漏该信息。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →