SimpleICL:低成本数据采集实现机器人上下文视觉学习,将全面开源
Minxing Li · hf · 2026-10-09
机器人上下文学习(ICL)让机器人从视觉演示中推断并执行任务,但演示同时传递动作轨迹、物体语义、可供性、空间关系等多重信息,学习目标一直含糊。
该工作:
- 首次给出机器人 ICL 的清晰问题定义,明确学习目标,消除提示歧义
- 提出极简可复现框架 SimpleICL,含视觉 prompt 编码器和低成本数据采集协议,无需大规模预训练或专门数据基础设施
- 在仿真与真实环境均取得强性能,实验揭示了动作、语义、组合、可供性区分等关键性质
数据和训练管线将全面开源。
「具身」频道最新
- KAIST 提出 ME-World:多智能体第一人称世界模型联合去噪生成 — kaist-ai · 2026-10-09
- Scoble 亲测 Tesla Cybercab:超出预期,还想买来出租 — Scobleizer · 2026-10-09
- 研究员称自我中心数据采集正当红,当年项目超前时代 — gragtah · 2026-10-09
- DreamTrue世界模型:反事实后训练把交互缺陷率从48%降到6% — Junyan Li · 2026-10-09
- NVIDIA USDCraft:用LLM写程序重建可操作的铰接3D资产 — nvidia · 2026-10-09
- 浙大 SuperNav:免微调 MLLM 加导航工具,任意场景执行任意任务 — zju3dv · 2026-10-09