Audex开源音频-文本大模型,多模态能力领先

_weiping · x · 2026-07-08

发布开源统一音频-文本大模型Audex,采用单个30B-A3B的MoE架构,将音频输入投影到文本嵌入空间。在音频理解、语音识别与翻译、语音合成、音频生成、语音到语音等任务上达到开源模型最佳水平,并在数学与代码推理、对齐和指令遵循上超过纯文本的Qwen3.5-35B-A3B。

所属事件:英伟达发布开源音频文本大模型 Audex-30B(9 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →