浙大清华提出INTACT:世界模型无需搜索直接输出动作

机器之心 · wechat · 2026-07-31

浙江大学、清华大学等团队提出 INTACT(INtent-To-ACTion),一种基于端到端 JEPA 的无搜索世界模型控制方法。该方法直接利用离线轨迹中的状态、动作与未来结果,将运动意图转化为动作模型可读取的语义接口。

传统世界模型在部署时常依赖 CEM 或 MPPI 从大量随机候选动作中反复预测和筛选,带来显著延迟。INTACT 创新性地引入共享的条件动作算子,让模型在复杂场景下也能无需搜索候选序列,直接生成动作计划;仅在精细接触等场景下引入小规模搜索进行验证。

实验显示,在四项 LeWM 官方任务上,INTACT 仅训练 1 个 epoch、零搜索即取得 95.33% 的平均成功率。开启小规模局部验证后成功率提升至 96.86%,且相比传统 9000 条候选序列,采样量减少 23.44 倍,规划延迟降至原来的 1/300。

所属事件:浙大清华推出免搜索世界模型INTACT(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →