英伟达发布 Nemotron-Audex-30B:统一音频-文本大模型
pmttyji · reddit · 2026-07-07
英伟达推出Nemotron-Labs-Audex-30B-A3B,基于30B MoE文本基座(仅激活3B参数)扩展音频能力,一体化支持音频理解、语音识别与翻译、文本转语音、音频生成及语音到语音生成,同时保留原有推理、知识与智能体能力,支持最长100万token上下文。模型遵循ChatML模板,支持thinking和instruct两种模式,现已在Hugging Face开放访问。
所属事件:英伟达发布开源音频文本大模型 Audex-30B(9 条相关)→
「多模态」频道最新
- 零编程经验者用 ChatGPT 开发 ComfyUI 安卓客户端将上架 — ComfierUI · 2026-09-11
- FastH3-Live 升至 22fps:加速节点实测与 ComfyUI 显存避坑 — spartong945 · 2026-09-11
- Midjourney 风格参考分享:--sref 2912175708 — tisch_eins · 2026-09-11
- Astra 分镜+Minimax H3 分镜逐帧生成,视频创作成功率大增 — Hailuo_AI · 2026-09-11
- Hailuo 转推:MiniMax H3 MAX 一发生成 15 秒美食动画短片 — Hailuo_AI · 2026-09-11
- MiniMax Music 制作工具包 2.5 发布,新增完整母带处理链 — Vivid_Promise1700 · 2026-09-11