ESPnet Releases YODAS v3, Largest Open Speech Dataset at 1.1M Hours

ESPnet released YODAS v3 on Hugging Face, a 1.1-million-hour dataset covering ASR, translation, and synthesis—the largest open audio dataset to date. Distributed in parquet format under a CC license, it quickly trended on Hugging Face.

2026-09-28 ~ 2026-09-28 · 2 related posts