KAIST 提出 ME-World:多智能体第一人称世界模型联合去噪生成
kaist-ai · hf · 2026-10-09
KAIST AI 提出 ME-World,将多智能体第一人称(egocentric)世界建模形式化为多个 ego 视频流的同步生成,解决跨视角动作一致、共享环境一致与交互状态传播一致三个难题。
方法上,它在共享 token 序列中联合去噪多条 ego 流,以所有智能体的目标视角位姿为条件,并用共享环境记忆做接地。团队构建了真实与合成多智能体数据训练,并提出环境/更新/身份一致性等共享世界评估指标,实验显示其在一致性、动作控制、身份保持与视频质量上均优于现有方法。
「具身」频道最新
- Embodied Turing Machines:纯代码策略 RoboDojo 42 项双臂任务成功率 70.24% — Kairui Hu · 2026-10-09
- AI Tinkerers 东京演示:照片转 AI 笔画再由 AxiDraw 画成纸面肖像 — Stefania_druga · 2026-10-09
- AssemblyAI 给童年玩具 Furby 加上语音 Agent,社区玩出花 — AssemblyAI · 2026-10-09
- Scoble 亲测 Tesla Cybercab:超出预期,还想买来出租 — Scobleizer · 2026-10-09
- 研究员称自我中心数据采集正当红,当年项目超前时代 — gragtah · 2026-10-09
- SimpleICL:低成本数据采集实现机器人上下文视觉学习,将全面开源 — Minxing Li · 2026-10-09