ActiveScale:模型-数据-硬件协同设计教机器人主动感知
Haoyu_Xiong_ · x · 2026-09-19
CMU 与港科大(广州)团队发布 ActiveScale 框架,通过模型、数据、硬件的统一协同设计,让 VLA 模型学会主动感知——在固定视角被遮挡时主动改变 viewpoint 获取信息:
- 模型:在 VLA 上引入历史视频观测与显式相机位姿监督,用逐帧 pose token 和轻量预测头关联跨视角观测,维持场景一致性理解;
- 数据:提出可扩展的人-机中期训练配方,用 1000 小时第一人称与机器人数据,利用人类活动中天然的相机运动来适配时序输入和位姿监督;
- 硬件:推出主动感知移动操作平台 AMP,支持单人遥操作,可规模化采集协调视角变化与操作的示范数据。
实验显示主动感知任务成功率提升,消融验证了位姿感知建模与第一人称数据的贡献。项目页提供代码、数据集与模型。
所属事件:CMU 等发布 ActiveScale:教机器人主动感知(2 条相关)→
「具身」频道最新
- AM-Bench:空中机械臂仿真基准,揭示开环不稳定系统策略学习全链路 — GuanyaShi · 2026-09-19
- 西北大学工程师造出每秒自旋 25 次的“隐形”无人机 Phantom Twist — churchkey · 2026-09-19
- Neuralink 帮 ALS 患者重获能力,暖心案例刷屏 — justin_hart · 2026-09-19
- Neuralink VOICE 试验:失语患者用植入物以自己原声说话 — flyme2mars · 2026-09-19
- 机器人「自己拔插头站起」视频爆火,实为 AGIBOT A3 真机 — jonstephens85 · 2026-09-19
- 机器人 AI 不能照搬 LLM 逻辑:5% 错误率就足以毁掉产品 — carlosdponx · 2026-09-19