Meta 新语音模型瞄准眼镜与 Agent:为嘈杂真实场景而造
heypearlai · x · 2026-09-04
Meta 发布的新语音识别模型定位为眼镜与 Agent 产品的「耳朵」——专门处理杂乱的真实房间环境,而非等待干净的「Hey Meta」唤醒指令。
- 论文给出的错误率之外,更值得注意的是其应用场景:Reality Labs 眼镜与 Agent 技术栈的语音入口
- 现已通过 Meta Model API、Meta AI for Mac 和 Muse Code 上线
- 作者提出疑问:脱离约 20 名知情被录制者的演示环境后,实际表现是否依然可靠
所属事件:Meta 发布流式语音模型,登顶 Artificial Analysis 榜单(3 条相关)→
「具身」频道最新
- 开源项目 Microduck 可教会机器人踢球,降低自主机器人入门门槛 — tristanbob · 2026-09-04
- Tesla 开放 Cybercab 车队采购意向表,第三方车队购买将成真 — JOBhakdi · 2026-09-04
- 开源人造肌肉预告:让机器人像人一样动起来 — IanPritchard · 2026-09-04
- 神秘银色头显 Dime 现身,Palmer Luckey 造势背后疑似 OpenAI 硬件布局 — rohanpaul_ai · 2026-09-04
- 1.4 万美元带激光雷达:BYD 天神之眼卷出auté供车新标配 — aronchick · 2026-09-04
- 2026 新名场面:网友自曝与机器人打羽毛球输掉了比赛 — lukas_m_ziegler · 2026-09-04