蚂蚁开源声纹模型 MECT:9.57M 参数百毫秒延迟追平 5.87 亿模型
aigclink · x · 2026-09-24
蚂蚁开源声纹验证模型 AntSpeaker/MECT,主打小与快,适合实时端侧场景。
- 将 MoE 引入全监督声纹训练,9.57M 小模型在 VoxCeleb1 上追平(平均指标反超)5.87 亿参数预训练模型
- 通过因果重训练实现 100ms 低延迟流式推理,精度接近离线水平
- 典型落地:银行/客服电话核身、App 登录、设备声纹唤醒解锁
- 论文、Hugging Face、GitHub 均已公开
与近期英伟达的语音日志模型形成互补:一个管"谁在何时说",一个管"是否同一人",都是语音管线上的专精组件。
所属事件:蚂蚁开源 9.57M 参数声纹模型,性能追平 5.87 亿参数大模型(2 条相关)→
「Infra」频道最新
- 12GB 显存本地跑 Qwen-Image 2.1,开源工具实测对比 GPT 输 4:11 — Sg1000deping · 2026-09-24
- 星舰第 14 次飞行满载在即,首搭 26 颗 V3 Starlink 卫星 — DimaZeniuk · 2026-09-24
- 禁大规模 AI 训练无需禁 GPU:管住超高带宽互连即可 — davidmanheim · 2026-09-24
- 自建 AI 推理栈必藏:10 个开源 GitHub 项目盘点 — Shruti_0810 · 2026-09-24
- 高通为骁龙 X2 承诺官方 Linux 支持,Ubuntu 认证瞄准 2027 年 — carrycooldude · 2026-09-24
- 阿里押注全栈:5-10T 参数 Qwen、50 万卡集群、2032 年 20GW 数据中心 — Div_pradeep · 2026-09-24