Meta 发布流式语音模型,登顶 Artificial Analysis 榜单

Meta 发布新的流式语音识别与说话人分离模型,定位为 AI 眼镜与 Agent 产品的「耳朵」,重点处理真实嘈杂房间中的多人对话,而非依赖干净的「Hey Meta」唤醒指令。Meta 宣布该模型在 9 月 1 日发布当天的统计中登上 Artificial Analysis 排行榜第一,除论文给出的错误率数据外,其真实场景能力被视为更大亮点。

2026-09-04 ~ 2026-09-04 · 3 条相关