ESPnet Releases YODAS v3, Largest Open Speech Dataset at 1.1M Hours
ESPnet released YODAS v3 on Hugging Face, a 1.1-million-hour dataset covering ASR, translation, and synthesis—the largest open audio dataset to date. Distributed in parquet format under a CC license, it quickly trended on Hugging Face.
2026-09-28 ~ 2026-09-28 · 2 related posts
- YODAS v3 lands on Hugging Face: 1.1M hours, the largest open speech dataset ever — shinjiw_at_cmu · 2026-09-28
- ESPnet's YODAS3 Speech Dataset with 1M+ Entries Trends on Hugging Face — espnet · 2026-09-28