Nemotron 3.5 Lightning 上线 Baseten,吞吐量提升 4 倍成本减半
baseten · x · 2026-08-11
推理平台 Baseten 宣布 Day 0 支持 NVIDIA 最新开源的 Nemotron 3.5 Lightning 模型。该模型专为长周期智能体设计,官方称其为同类开源模型中最快的选择。
与同等规模的开源模型相比,Nemotron 3.5 Lightning 在生产测试中展现出显著优势:吞吐量高出 4 倍,成本降低 50%,且输出 token 数量减少了 63.4%。模型采用 30B MoE 架构(激活参数 3B),并支持 100 万 token 的上下文长度。
「模型」频道最新
- OpenRouter 数据:推理模型 Token 占比已突破 60% — Beth_Kindig · 2026-08-11
- LlamaIndex 推出 ExtractBench:企业文档提取新基准 — llama_index · 2026-08-11
- 实测Meta新模型Muse Glimmer:30B专为智能体优化 — altryne · 2026-08-11
- 英伟达更新 30B 混合架构模型,蒸馏使其智商飙升 70% — PavloMolchanov · 2026-08-11
- 智谱 GLM Coding Plan 用户破百万,官方宣布重置用量额度 — sumitdotml · 2026-08-11
- 被“两件事”洗脑:网友吐槽 Claude 疯狂重复固定句式 — Extension_Hair8591 · 2026-08-11