腾讯混元发布 HyASR3.0 语音模型,多语种 WER 降至 3% 左右
机器之心 · wechat · 2026-08-04
腾讯混元发布新一代语音识别模型 HyASR3.0 preview。该模型基于大语言模型 Hy3,采用 MoE 架构与自研无监督语音 Encoder,将高精度语音识别与深度语义理解相融合。
在开源评测集中,HyASR3.0 preview 的多语种词错误率(WER)控制在 3% 左右(中文 3.34%、英语 2.62%、粤语 3.12%)。模型重点提升了通用识别准确性、上下文智能纠错、专业场景热词注入以及高噪/耳语等复杂声学环境下的稳定性。目前该模型已上线腾讯云提供 API 服务,并接入腾讯元宝 App。
所属事件:腾讯混元发布新一代语音识别模型HyASR3.0(2 条相关)→
「模型」频道最新
- 专家实测 GPT-5.6 与 Gemini 机器人模型:能力惊艳仍缺真实数据 — m_wulfmeier · 2026-08-04
- 体验远逊GPT?开发者吐槽Gemini Live语音缺乏情感 — TheBuzzer4625kHz · 2026-08-04
- 7月AI大事件:模型价格战打响,开源追平闭源 — Dapper-Tale-4021 · 2026-08-04
- 实测替换 Codex 底层模型:Kimi K3 生成营销方案成本仅为 GPT-5.6 的四分之一 — AskItAll_Biych · 2026-08-04
- DeepSeek V4 成本仅为 Claude 1%:中国 AI 模型掀起价格战 — SirBoboGargle · 2026-08-04
- OpenAI 暗示下一代模型需更强算力,Codex 或向云端智能体演进 — haider1 · 2026-08-04