NVIDIA 发 Nemotron 3.5 Lightning:30B 小 MoE 主打 Agent 执行层

cwolferesearch · x · 2026-08-18

NVIDIA 扩充 Nemotron 模型家族,新发布的 Nemotron 3.5 Lightning 是一个 30B 参数(3B 激活)的小型 MoE 模型,面向高吞吐、低延迟场景。

其定位是 agent 工作流中的「执行层」:由 Nemotron 3 Ultra 这类前沿推理模型负责规划编排,把验证工具输出、执行命令、解决简单子任务等高频操作交给 3.5 Lightning。模型针对 agent 场景专门训练,兼容 hermes、openclaw 等框架。

推理优化方面,模型用多 token 预测训练以支持投机解码,并附带 DSpark/DFlash 的 drafter 与量化 checkpoint。速度为同规模模型的 4 倍,在 Artificial Analysis 智能指数上于其速度档位表现突出。NVIDIA 还提供了开箱即用的微调 recipe,便于后训练出低成本高可靠的专用模型。

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →