英伟达发布 Nemotron-Audex-30B:统一音频-文本大模型

pmttyji · reddit · 2026-07-07

英伟达推出Nemotron-Labs-Audex-30B-A3B,基于30B MoE文本基座(仅激活3B参数)扩展音频能力,一体化支持音频理解、语音识别与翻译、文本转语音、音频生成及语音到语音生成,同时保留原有推理、知识与智能体能力,支持最长100万token上下文。模型遵循ChatML模板,支持thinking和instruct两种模式,现已在Hugging Face开放访问。

所属事件:英伟达发布开源音频文本大模型 Audex-30B(9 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →