阿里发布 Qwen-Audio-3.0-ASR-Flash 语音模型
阿里通义千问团队发布最新语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点解决专业词汇识别与长音频连贯性问题。该模型支持上下文一致性记忆、热词定制化以及多达 30 种语言。在具体性能表现上,其在医疗场景的专业词汇“听中率”已超过 95%,显著提升了行业术语与复杂音频的处理能力。
2026-07-31 ~ 2026-07-31 · 3 条相关
- 通义千问发布Qwen-Audio-3.0-ASR,支持长音频上下文与30种语言 — 千问大模型 · 2026-07-31
- 通义千问发布 Qwen-Audio-3.0-ASR-Flash,强化热词与领域识别 — Alibaba_Qwen · 2026-07-31
- 阿里发布 Qwen-Audio-3.0-ASR:医疗专业词识别率超 95% — 智东西 · 2026-07-31