腾讯混元发布 HyASR3.0:多语种 WER 降至 3% 左右
腾讯混元 · wechat · 2026-08-04
腾讯混元正式发布新一代语音识别模型 HyASR3.0preview。该模型基于大语言模型 Hy3,采用 MoE 架构与自研无监督语音 Encoder,将高精度语音识别与深度语义理解相融合。
官方数据显示,在多个开源评测集中,HyASR3.0preview 的多语种词错误率(WER)均控制在 3% 左右(中文普通话 3.34%、英语 2.62%、粤语 3.12%)。模型重点提升了通用识别准确性、上下文意图理解、专业场景适配(支持热词注入)以及复杂声学环境(高噪、耳语)下的稳定性。目前该模型已上线腾讯云提供 API 服务,并在腾讯元宝 App 首发集成。
所属事件:腾讯混元发布新一代语音识别模型HyASR3.0(2 条相关)→
「模型」频道最新
- 实测替换 Codex 底层模型:Kimi K3 生成营销方案成本仅为 GPT-5.6 的四分之一 — AskItAll_Biych · 2026-08-04
- 腾讯混元发布 HyASR3.0 语音模型,多语种 WER 降至 3% 左右 — 机器之心 · 2026-08-04
- ChatGPT 频繁破坏代码库,开发者抱怨模型能力倒退 — wowa93 · 2026-08-04
- DeepSeek V4 成本仅为 Claude 1%:中国 AI 模型掀起价格战 — SirBoboGargle · 2026-08-04
- OpenAI 暗示下一代模型需更强算力,Codex 或向云端智能体演进 — haider1 · 2026-08-04
- 企业级AI部署痛点:模型切换成本远超性能差距 — sanjaykalra · 2026-08-04