41.5万小时全双工对话语音数据集发布,训练口语对话模型
kastnerkyle · x · 2026-09-10
wataru9871 宣布发布 41.5 万小时(k hours ×415)的全双工对话语音数据集,专为训练全双工口语对话模型打造。数据集配套放出论文与代码,是该领域迄今规模极大的公开资源,对做语音交互和实时对话模型的开发者有直接价值。
「研究」频道最新
- 统一自编码论文 The Prism Hypothesis 入选 ECCV 2026,为无编码器 MLLM 铺路 — liuziwei7 · 2026-09-10
- 退化 Fisher 信息解释神经网络为何不违奥卡姆剃刀 — FrnkNlsn · 2026-09-10
- AIxBio 学者:别谈苦涩教训,钱多堆算力效率其实更低 — anshulkundaje · 2026-09-10
- GPN-Star 基因组建模论文登刊,Yun Song 团队被赞 AIxBio 研究范式 — anshulkundaje · 2026-09-10
- TAMER 浏览器演示:直观展示人类反馈如何实时改变 RL 策略 — PeterStone_TX · 2026-09-10
- 开源音乐模型 YuE2 发布:先写旋律和弦谱再渲染成歌 — GreyScope · 2026-09-10