NVIDIA 发布 Nemotron 3.5 Lightning 模型,专为智能体提速
kuchaev · x · 2026-08-11
NVIDIA 发布了专为高并发智能体负载设计的开源模型 Nemotron 3.5 Lightning。
- 架构与性能:基于 Nemotron 3.0 Nano(30B MoE,3B 激活参数),通过更新预训练、中间训练以及新的 SFT 和 RLVR 流水线,使其准确度逼近 3.0 Super 级别。
- 推理加速:结合增强的 MTP heads 以及 DFlash 和 DSpark 推测解码技术,大幅提升了吞吐量,速度最高可达同级别模型的 4 倍。
所属事件:NVIDIA发布Nemotron 3.5 Lightning与NeMo Switchyard开源(22 条相关)→
「Infra」频道最新
- 大模型推理优化:为什么要做分离式预填充 — charles_irl · 2026-08-11
- 英伟达研究:小语言模型将重塑AI,与LLM走向协同互补 — goyalshaliniuk · 2026-08-11
- 揭秘 AI 算力交易:谁是「Token 经纪人」? — thisguy123123 · 2026-08-11
- Claude 主笔 PyTorch 技术博客:详解主机到设备同步的性能陷阱 — ezyang · 2026-08-11
- OpenAI 招电力交易员对冲数据中心能耗成本 — Justgototheeffinmoon · 2026-08-11
- 分析师 Ben Bajarin:当前行业算力严重短缺 — BenBajarin · 2026-08-11