NVIDIA 发布 30B MoE 模型,专为高并发智能体优化

ziqiao_ma · x · 2026-08-12

NVIDIA 发布了全新的开源模型 Nemotron 3.5 Lightning。该模型总参数量为 30B,采用混合专家架构,激活参数仅为 3B。其重点优化了吞吐量与延迟,专为需要快速响应的常驻型 AI 智能体设计,输出速度最高可达同级别模型的 4 倍。目前已上线 Tinker 平台。

所属事件:NVIDIA发布Nemotron 3.5 Lightning模型与NeMo Switchyard路由库(42 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →