LeAVJEPA: Minimal Audio-Video Self-Supervised Encoder Hits AudioSet 36.0 mAP
Aalto University's Arno Solin team introduced LeAVJEPA, the first audio-video self-supervised encoder built on LeJEPA's collapse-free objective. It uses a single shared Transformer encoder and reaches 36.0 mAP on AudioSet in frozen evaluation.
2026-10-08 ~ 2026-10-08 · 2 related posts
- LeAVJEPA: one shared encoder for label-free audio-video self-supervised learning — arnosolin · 2026-10-08
- LeAVJEPA: minimalist audio-visual SSL hits 36.0 mAP on AudioSet and 91.3% on ESC-50 frozen — arnosolin · 2026-10-08