Uni-LaDiR Unifies Multimodal Reasoning via Latent Diffusion
Researchers introduce Uni-LaDiR, a unified reasoning framework for VLMs and VLAs that performs reasoning via diffusion in a modality-agnostic latent space, unifying image, text, and 3D reasoning.
2026-10-06 ~ 2026-10-07 · 2 related posts
- Uni-LaDiR unifies image, text and 3D reasoning via latent diffusion thoughts — Lianhuiq · 2026-10-06
- Uni-LaDiR unifies reasoning across modalities via latent diffusion thoughts — Lianhuiq · 2026-10-07