KAIST 提出 ME-World:多智能体第一人称世界模型联合去噪生成

kaist-ai · hf · 2026-10-09

KAIST AI 提出 ME-World,将多智能体第一人称(egocentric)世界建模形式化为多个 ego 视频流的同步生成,解决跨视角动作一致、共享环境一致与交互状态传播一致三个难题。

方法上,它在共享 token 序列中联合去噪多条 ego 流,以所有智能体的目标视角位姿为条件,并用共享环境记忆做接地。团队构建了真实与合成多智能体数据训练,并提出环境/更新/身份一致性等共享世界评估指标,实验显示其在一致性、动作控制、身份保持与视频质量上均优于现有方法。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →