Qwen-Audio-3.1 四款模型已可调用,ASR-Flash 定价 0.8 元/M tokens
aigclink · x · 2026-09-23
同一作者补充了 Qwen-Audio-3.1 系列各模型的 API 入口:ASR、TTS、TTS-Next、Realtime 均已上线,ASR-Next API 即将推出。
模型页显示 Qwen-Audio-3.1-ASR-Flash 面向短语音高效识别,支持多语种与多地区中文方言、古诗词韵律优化、上下文增强与工业级分角色转写;输入定价 ¥0.8/M tokens、输出 ¥2.7/M tokens,速率限制每分钟 600 次请求,支持函数调用、结构化输出与批量任务。
所属事件:千问发布五款语音模型,ASR 价格直降 95%(4 条相关)→
「多模态」频道最新
- 开发者用 Codex+GPT Image 2.5 自动生成角色替换 LoRA 数据集 — ostrisai · 2026-09-23
- 腾讯混元 Image3.5 preview 上线,发布即限时免费 — HeyAmit_ · 2026-09-23
- 实测腾讯 Hy Image 3.5:文字排版与编辑控制是亮点 — HeyAmit_ · 2026-09-23
- ImIR 用图像自身作指令单适配器搞定六种图像修复 — Süleyman Aslan · 2026-09-23
- Qwen 发布五个音频模型,TTS 降价 70%、ASR 最高降 95% — Alibaba_Qwen · 2026-09-23
- 微软发布 MAI-Transcribe 2:支持多语言转写、说话人分离与时间戳 — lee_stott · 2026-09-23