Qwen 发布音频全家桶 Qwen-Audio-3.1,TTS 降价约 70%
airesearch12 · x · 2026-09-23
阿里巴巴 Qwen 团队发布 Qwen-Audio-3.1 音频模型家族,共五款模型覆盖理解、生成、交互与创作:
- ASR/ASR-Next:多语言与方言识别增强,原生文本润色可自动去除语气词与重复;ASR-Next 支持多说话人标注、时间戳对齐转写,并能理解情绪、环境音与机器声
- TTS/TTS-Next:面向音频创作
- Realtime:实时语音交互全面升级
价格方面全线大幅下调:TTS 约 70% 折扣,Realtime 约 85%,ASR 最高 95%。是否开源权重尚未确认。
所属事件:阿里Qwen发布五款音频模型,语音API大幅降价(5 条相关)→
「模型」频道最新
- 曝中国团队以 1/15 成本逼近 GPT-5.6 水平,RL 训练仅花 260 万美元 — djcows · 2026-09-23
- 追不动了:要失业才有空追 AI,打工才有钱用 AI — FlolightC · 2026-09-23
- gpt-6-luna 文本抽取实测:成本减半,准度不输 gpt-5.6 — charliermarsh · 2026-09-23
- 开发者实测 Opus 5.5:数周未解的 bug 一举找出 — doodlestein · 2026-09-23
- 爆料:OpenAI Daybreak 文档现 GPT-6 Astra Minor,疑似填补 Sol 与 Astra 之间空档 — brandon_galang · 2026-09-23
- Meta Muse Spark 数据飞轮启动:用户代理数据将反哺后续模型 — brandon_galang · 2026-09-23