NVIDIA 发 Nemotron 3.5 Lightning:30B 小 MoE 主打 Agent 执行层
cwolferesearch · x · 2026-08-18
NVIDIA 扩充 Nemotron 模型家族,新发布的 Nemotron 3.5 Lightning 是一个 30B 参数(3B 激活)的小型 MoE 模型,面向高吞吐、低延迟场景。
其定位是 agent 工作流中的「执行层」:由 Nemotron 3 Ultra 这类前沿推理模型负责规划编排,把验证工具输出、执行命令、解决简单子任务等高频操作交给 3.5 Lightning。模型针对 agent 场景专门训练,兼容 hermes、openclaw 等框架。
推理优化方面,模型用多 token 预测训练以支持投机解码,并附带 DSpark/DFlash 的 drafter 与量化 checkpoint。速度为同规模模型的 4 倍,在 Artificial Analysis 智能指数上于其速度档位表现突出。NVIDIA 还提供了开箱即用的微调 recipe,便于后训练出低成本高可靠的专用模型。
「Infra」频道最新
- 骁龙 X2 Elite 实测 AI 性能超竞品 2 倍 — ryanshrout · 2026-08-18
- 手握 64GB 内存和 2TB SSD,求组建低成本本地 AI 主机方案 — joquinjack · 2026-08-18
- Mesh LLM 开源:算力共享介于矿机与云服务之间 — alex_verem · 2026-08-18
- 超频 4 张 5060Ti 显存跑 Qwen3.8-27B — Ok-Breakfast1878 · 2026-08-18
- Qwen3.8-9B MLX版登苹果芯片,16GB Mac可跑 — alexcovo_eth · 2026-08-18
- 利用AI重写内核,Qwen 3.8在苹果硅谷提速近3倍 — alexcovo_eth · 2026-08-18