用人类纠正数据适配机器人模型
micoolcho · x · 2026-07-16
这条讨论的是:现代视觉-语言-动作模型和世界动作模型已经能做出不错的操控,但**迁移到新机器人、新任务**时仍然很难可靠适配。 提出的思路是用 **DAgger 风格的在线模仿学习**: - 先把机器人部署出去 - 持续收集人类纠正数据 - 再更新策略,而不是只靠离线微调 作者还补充说,如果有类似的轨迹/人类纠正数据,可能值得把 **DAgger 式数据**在更多任务和环境里规模化积累。
所属事件:FlowDAgger:用人类纠正数据适配机器人模型(2 条相关)→
「具身」频道最新
- LimX 模块化 TRON 机器人把轮式速度和爬楼能力结合起来 — chris_j_paxton · 2026-07-21
- 仓储演示引争论:AMR 加机械臂或比人形更实用 — BradPorter_ · 2026-07-21
- Generative Bionics 人形机器人六个月走到可行走平台 — CyberRobooo · 2026-07-21
- Auki 推出面向门店、仓库和供应链的物理 AI 基础设施 — broodsugar · 2026-07-21
- 安全强化学习方向约束论文被 IROS 2026 接收 — Jan_R_Peters · 2026-07-21
- Sunday Robotics 称只需一个样本就能教家用机器人新动作 — saranormous · 2026-07-21