Mask Forcing curbs mode collapse in autoregressive video diffusion distillation

Zhuoran Zhao · hf · 2026-09-09

Mask Forcing, a new method on Hugging Face, tackles mode collapse in distilled autoregressive video diffusion models by injecting masked, cleaner signals during self-rollout, improving visual quality without any extra training data.

Original post →

More from Multimodal

Multimodal channel →