清华联合伯克利提出连续时间具身世界模型 ODEWorld

新智元 · wechat · 2026-08-05

清华大学智能产业研究院(AIR)与 UC Berkeley BAIR 团队联合提出了全球首个连续时间具身世界模型 ODEWorld。传统视觉世界模型依赖离散帧预测,难以捕捉两帧之间的物理瞬间变化,而 ODEWorld 转向直接学习世界在真实物理时间中的连续变化率。

核心技术设计:

能力与性能:

基于常微分方程(ODE)求解器进行积分,ODEWorld 将原本独立的任意帧率生成、时间补全(补帧)与反向生成统一为同一套连续时间预测范式(PT-Flow)。

在 LIBERO 视频预测实验中,ODEWorld 在 64 帧长程预测上不仅画质(PSNR/LPIPS)优于 LDP 和 V-JEPA2,且生成速度极快:生成 64 帧仅需 0.072 秒,分别是 LDP 的 1/55 和 V-JEPA2 的 1/8.6。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →