Qwen-Audio-3.1 发布:五款模型覆盖语音理解到生成全链路
Scobleizer · x · 2026-09-28
阿里通义语音团队发布 Qwen-Audio-3.1,对 ASR(语音识别)、TTS(语音合成)与 Realtime 实时交互进行全线升级,并推出两款新模型:面向音频创作的 TTS-Next 和面向音频理解的 ASR-Next。
「多模态」频道最新
- AI 产品摄影新突破:奶油膏体质感终于不再像史莱姆 — Stock_Appeal_8654 · 2026-09-28
- 开源 Claude 动画起步套件:p5.brush 驱动手绘角色,内置 31 种情绪 — FinanceYF5 · 2026-09-28
- Seedance 2.5 复刻千禧年 DV 录像质感,超写实 AI 视频引惊叹 — SimplyAnnisa · 2026-09-28
- 两个 ComfyUI 节点修复 Qwen 2.1 图像编辑像素漂移 — Technical_Fish_9638 · 2026-09-28
- Suno 配 GPT-6-Astra 打造歌词驱动动画的趣味 demo — earlvanze · 2026-09-28
- 单条提示词生成 2.5 分钟宇宙终结短片,音乐画面同步 — burny_tech · 2026-09-28