NAPE: Self-Supervised Audio Learning via Patch Prediction

ImperialCollegeLondon · hf · 2026-08-21

Imperial College London introduces NAPE (Listening Forward), a method using causal Transformers to predict successive spectrogram patch embeddings for scalable self-supervised audio learning without auxiliary components.

Original post →

More from Research

Research channel →