浙大清华提出INTACT:世界模型无需搜索直接输出动作
机器之心 · wechat · 2026-07-31
浙江大学、清华大学等团队提出 INTACT(INtent-To-ACTion),一种基于端到端 JEPA 的无搜索世界模型控制方法。该方法直接利用离线轨迹中的状态、动作与未来结果,将运动意图转化为动作模型可读取的语义接口。
传统世界模型在部署时常依赖 CEM 或 MPPI 从大量随机候选动作中反复预测和筛选,带来显著延迟。INTACT 创新性地引入共享的条件动作算子,让模型在复杂场景下也能无需搜索候选序列,直接生成动作计划;仅在精细接触等场景下引入小规模搜索进行验证。
实验显示,在四项 LeWM 官方任务上,INTACT 仅训练 1 个 epoch、零搜索即取得 95.33% 的平均成功率。开启小规模局部验证后成功率提升至 96.86%,且相比传统 9000 条候选序列,采样量减少 23.44 倍,规划延迟降至原来的 1/300。
所属事件:浙大清华推出免搜索世界模型INTACT(2 条相关)→
「具身」频道最新
- Qlayers机器人替代高危人工,储罐喷涂效率提升六倍 — lukas_m_ziegler · 2026-07-31
- 50余家机构联手,打造全球最大触觉操作数据集 — RemiCadene · 2026-07-31
- 高通冲刺 AI 游戏时代:端侧算力将开发周期缩至 5 天 — 智东西 · 2026-07-31
- 清华等提出 Harness VLA,无需重训让冻结机器人模型成功率大增 — jiqizhixin · 2026-07-31
- 专家揭示机器人演示视频的潜规则:所见即所得 — chris_j_paxton · 2026-07-31
- HiFi-UMI:机器人下一阶段突破靠更高保真数据而非大模型 — mattpocockuk · 2026-07-31