Nemotron 3.5 Lightning 实测:670 tokens/秒,主打极速智能体
ArtificialAnlys · x · 2026-08-11
据 Artificial Analysis 实测,NVIDIA 新发布的 Nemotron 3.5 Lightning 是一款主打极致效率的开源小模型。它总参数量 31.6B(激活 3.6B),在保持与上代相近体积的同时,实现了智能与速度的双重跃升。
核心数据与亮点:
- 智能大幅提升:在 Artificial Analysis 智能指数中得分 24,较上代(15)提升 9 分,追平了更大参数的 gpt-oss-120b。
- 极致推理速度:在 DeepInfra 的 NVFP4 量化端点上,输出速度高达 670 tokens/秒,远超同级别模型。
- 智能体能力跨越:在 Terminal-Bench v2.1 评测中得分 24%(上代仅 7%),并在 GDPval-AA v2 中超越了自家更大的 Super 版本。
- 开源与可用性:采用 OpenMDW-1.1 许可证,支持免费商用,提供 100 万 token 上下文,现已上线多家推理服务商。
所属事件:Nemotron 3.5 Lightning实测主打极速推理(2 条相关)→
「模型」频道最新
- Anthropic 为 Claude 全局嵌入不可见文本水印 — eyishazyer · 2026-08-11
- Anthropic 将为 Claude 输出嵌入不可见水印以合规 — lilyraynyc · 2026-08-11
- 吐槽 Gemini 表现不佳:仍沿用旧版 DeepSeek-R1 推理风格 — scaling01 · 2026-08-11
- 曝 GPT-5.6-Sol 思维链极简:OpenAI 演绎《办公室》梗 — scaling01 · 2026-08-11
- Nemotron 3.5 Lightning 上线 Baseten,吞吐量提升 4 倍成本减半 — baseten · 2026-08-11
- Anthropic 将为 Claude 输出嵌入不可见水印以合规 — VampyreLust · 2026-08-11