腾讯混元发布 HyASR3.0:多语种 WER 降至 3% 左右

腾讯混元 · wechat · 2026-08-04

腾讯混元正式发布新一代语音识别模型 HyASR3.0preview。该模型基于大语言模型 Hy3,采用 MoE 架构与自研无监督语音 Encoder,将高精度语音识别与深度语义理解相融合。

官方数据显示,在多个开源评测集中,HyASR3.0preview 的多语种词错误率(WER)均控制在 3% 左右(中文普通话 3.34%、英语 2.62%、粤语 3.12%)。模型重点提升了通用识别准确性、上下文意图理解、专业场景适配(支持热词注入)以及复杂声学环境(高噪、耳语)下的稳定性。目前该模型已上线腾讯云提供 API 服务,并在腾讯元宝 App 首发集成。

所属事件:腾讯混元发布新一代语音识别模型HyASR3.0(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →