pyannote 说话人分离社区模型 1 登上 Hugging Face 热门榜
pyannote · hf · 2026-09-05
pyannote 团队发布的 speaker-diarization-community-1 正登上 Hugging Face 热门模型榜。该模型属于自动语音识别 pipeline,基于 pyannote-audio 框架,支持说话人分离(speaker diarization)、说话人变化检测与语音活动检测(VAD),可用于把音频按不同说话人切分,是语音转写与会议记录工作流的常用基础组件。
「多模态」频道最新
- MAI-Image-2.6-Flash 定价争议:微软连每百万 token 价格都不公布 — oyacaro · 2026-09-05
- Suno V6 音乐生成模型即将发布 — op7418 · 2026-09-05
- 创作者用 fal H3 Max 搭建可乱入的 90 年代情景喜剧互动剧场 — gorkem · 2026-09-05
- Orbis 论文:将视频生成变为可持续运行的可控视觉过程 — rohanpaul_ai · 2026-09-05
- Pocket FM 年入 2 亿美元后砍掉旧模式,全面转向 AI 生产爆款 — thisguyknowsai · 2026-09-05
- Intangible 上线 Motion Paths:画一条线即可编排 3D 运动路径 — azed_ai · 2026-09-05