ESPnet 发布百万级语音数据集 YODAS3,覆盖识别、翻译与合成
espnet · hf · 2026-09-28
ESPnet 团队的语音数据集 yodas3 登上 Hugging Face 热门榜。数据集规模在 100 万到 1000 万条之间,以 parquet 格式发布,采用 CC-BY-3.0 许可,标注任务涵盖语音识别(ASR)、音频到音频、文本转语音(TTS)和翻译,包含音频、文本和表格多种模态。
所属事件:ESPnet 发布 110 万小时开源语音数据集 YODAS v3(2 条相关)→
「研究」频道最新
- 神经科学家驳「AI 非大脑」论:前沿模型表征已可预测灵长类皮层活动 — coherence · 2026-09-28
- BoundInk 把字间边界作为显式生成单元,在线手写生成质量大幅提升 — SUNGKYUNARCH · 2026-09-28
- TUM 提出 Continuous Depth Batching,循环语言模型自适应推理提速 99% — TUM · 2026-09-28
- ARGUS 用 LLM 审计气候政策研究的因果识别假设,缺陷检出率 73% — Yonghong Zhang · 2026-09-28
- 用范畴论给深度学习画图:PyNCD 把 FlashAttention 画在餐巾上 — GioeleZardini · 2026-09-28
- 交互式实验室手动选下一个词,直观演示采样与温度机制 — CurieuxExplorer · 2026-09-28