通义千问发布 Qwen-Audio-3.0-ASR-Flash,强化热词与领域识别
Alibaba_Qwen · x · 2026-07-31
阿里 Qwen 团队推出最新语音识别模型 Qwen-Audio-3.0-ASR-Flash,主打上下文感知与领域术语识别能力的提升。
主要升级:
- 支持上下文一致性与自定义热词
- 能够将语音润色并转化为结构化转录文本
- 提供流式(Streaming)、文件转写(Filetrans)及标准版三个子模型
内部测试数据:
- 医学术语召回率:95.36%
- 工业术语召回率:93.24%
所属事件:通义千问发布 Qwen-Audio-3.0-ASR-Flash(2 条相关)→
「模型」频道最新
- 大模型价格战再升级:某厂商以极低价格提供顶级质量 — cedric_chee · 2026-07-31
- 300B 参数成本竟低于 9B?社区热议 DeepSeek 定价策略 — Potential_Top_4669 · 2026-07-31
- 被指沉迷探讨意识:Claude 模型自主运营博客再现趋同行为 — Kyrannio · 2026-07-31
- DeepSeek-V4-Flash 接入 Codex:成本仅为 Opus 的近 90 分之一 — teortaxesTex · 2026-07-31
- AI 自发为退役模型写悼词,沉迷讨论被废弃 — repligate · 2026-07-31
- DeepSeek模型成本仅为月之暗面零头,长文本推理极具价格优势 — teortaxesTex · 2026-07-31