NVIDIA 发布 30B MoE 模型,专为高并发智能体优化
ziqiao_ma · x · 2026-08-12
NVIDIA 发布了全新的开源模型 Nemotron 3.5 Lightning。该模型总参数量为 30B,采用混合专家架构,激活参数仅为 3B。其重点优化了吞吐量与延迟,专为需要快速响应的常驻型 AI 智能体设计,输出速度最高可达同级别模型的 4 倍。目前已上线 Tinker 平台。
所属事件:NVIDIA发布Nemotron 3.5 Lightning模型与NeMo Switchyard路由库(42 条相关)→
「模型」频道最新
- 独立大模型厂商调用量激增,Token份额已超头部大厂总和 — shensi · 2026-08-12
- SGLang 实现本地高效运行 Nemotron 3.5:支持 1M 上下文 — BanghuaZ · 2026-08-12
- GPT与Claude成功破解困扰25年的信息论难题 — weijie444 · 2026-08-12
- 企业 AI 走向专有小模型:99% 算力被通用大模型浪费 — blaizedsouza · 2026-08-12
- Mistral 旧模型被挖出:思维链“乱码”无缝过渡至清晰回复 — aiamblichus · 2026-08-12
- ChatGPT 离奇 Bug:主动推送奇怪提示词并自己回答自己 — sennepo · 2026-08-12