CMU's CoVeR: Training-Free Token Pruning That Preserves Multi-View 3D Reasoning in VLMs

CarnegieMellonU · hf · 2026-09-09

Carnegie Mellon researchers released CoVeR, a training-free spatial token selector for vision-language models doing multi-view 3D reasoning.

Original post →

More from Research

Research channel →