阿里 Qwen 发布 Audio 3.1 五款音频模型,语音价格最高降 95%
The Decoder · rss · 2026-09-23
阿里通义(Qwen)发布 Qwen-Audio-3.1 系列,共五款模型,覆盖语音识别(ASR)、语音合成(TTS)和实时交互,同时将 AI 音频价格下调最高 95%。
- ASR 模型改进多语言与方言识别,自动清理语气词和重复词
- ASR-Next 支持多说话人识别并带时间戳,可检测情绪、环境声和机器噪声
- TTS 支持多语言合成(原文此处截断)
- 配合最高 95% 的降价,明显意在抢占语音 API 市场
「模型」频道最新
- 用户称 Opus 5.5 是 4.6 以来最大升级,担忧高量化版先发再降智 — haider1 · 2026-09-23
- 匿名 AI 平台 Venice 上线 Claude Opus 5.5,可无账号使用 — juanbenet · 2026-09-23
- 开源追上闭源?ARK 分析师:前沿实验室内部迭代反可拉大差距 — skorusARK · 2026-09-23
- Rails Agent 评测:OpenAI 保持领先,黑马 Luna Max 11 美元拿下 18% 完成率 — npew · 2026-09-23
- Pangram v4 把 2020 年前的数千行长文判成 100% AI 生成 — birchlse · 2026-09-23
- 手机上看 Artificial Analysis 模型发布曲线:陡峭得像指数预测图 — StrategicHarmony · 2026-09-23