Open-Source Embodied Video Generation Model Released

rohanpaul_ai · x · 2026-07-10

LingBot-Video is an open-source video generation model tailored for embodied scenarios, featuring a MoE design. The 30B main model activates only 3B parameters during each generation, reportedly achieving significantly better inference efficiency than dense architectures on 1M token sequences.

Related event: Ant Group Open-Sources LingBot-Video for Embodied AI(26 posts)→

Original post →

More from Embodied

Embodied channel →