腾讯混元发布 HyASR3.0 语音模型,多语种 WER 降至 3% 左右

机器之心 · wechat · 2026-08-04

腾讯混元发布新一代语音识别模型 HyASR3.0 preview。该模型基于大语言模型 Hy3,采用 MoE 架构与自研无监督语音 Encoder,将高精度语音识别与深度语义理解相融合。

在开源评测集中,HyASR3.0 preview 的多语种词错误率(WER)控制在 3% 左右(中文 3.34%、英语 2.62%、粤语 3.12%)。模型重点提升了通用识别准确性、上下文智能纠错、专业场景热词注入以及高噪/耳语等复杂声学环境下的稳定性。目前该模型已上线腾讯云提供 API 服务,并接入腾讯元宝 App。

所属事件:腾讯混元发布新一代语音识别模型HyASR3.0(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →