NVIDIA 发布 Nemotron 3 说话人分离模型,支持 8 人重叠语音
andimarafioti · x · 2026-09-24
NVIDIA 发布 Nemotron 3 Diarization 模型,可在多人同时说话、声音重叠的场景下追踪谁在何时发言,最多支持 8 个说话人,参数量仅 1 亿,已在 Hugging Face 上线,并实现 day 0 支持 Transformers 库,开发者可直接调用构建转写类应用。
所属事件:NVIDIA 开源 Nemotron 3 说话人分离模型登顶榜单(11 条相关)→
「模型」频道最新
- StarDoc 开源 TeleOCR 文档解析模型,基于 Qwen2.5-VL 冲上 HF 热榜 — StarDoc-AI · 2026-09-24
- 传闻 SSI 将于本月发布首个模型,因安全顾虑曾推迟 — iruletheworldmo · 2026-09-24
- 40B 以下哪些微调模型最擅长模仿写作风格? — Borkato · 2026-09-24
- Opus 5.5 首日口碑:用户称直接取代了 Astra — kimmonismus · 2026-09-24
- 用户盛赞 Anthropic Opus 5.5,Bolt 视频经 4 轮小改即成片 — seanwbren · 2026-09-24
- 开源多模态决策模型 XOR 发布:基于 Qwen,26 万上下文 — TheMoonMidas · 2026-09-24