Evidence-RL: Eliminating VLM Shortcuts via Counterfactual Causal Intervention

Haojie Huang · hf · 2026-08-11

Current Vision-Language Models (VLMs) often rely on language priors or dataset shortcuts. This paper proposes Counterfactual Evidence Disentanglement (CED) to audit VLM grounding during training.

Original post →

More from Research

Research channel →