Introducing Flex-π: A Multi-Stream World-Action Model for Robotics

abhishekunique7 · x · 2026-08-13

Researchers introduced Flex-π, a multi-stream World-Action Model (WAM). The model jointly predicts future RGB, 3D pointmaps, and DINO semantics with actions during training, enabling it to inherit strong 3D, object-centric, and spatio-temporal priors for action generation.

Related event: Flex-π: A 6B Parameter World-Action Model for Robotics(3 posts)→

Original post →

More from Embodied

Embodied channel →