NVIDIA 发布 Nemotron 3.5 Lightning,专为本地智能体设计

ollama · x · 2026-08-12

NVIDIA 宣布 Nemotron 3.5 Lightning 模型登陆 Ollama,支持完全在本地设备运行。该模型总参数量 30B,每个 token 激活参数仅 3B,采用混合专家架构,专为需要长期运行、收集上下文和调用工具的智能体任务打造。

模型支持最高 100 万 token 上下文,并针对推理进行优化,通过多 token 预测提供最高 4 倍的吞吐量提升。它可广泛应用于本地个人助手、代码子智能体和安全运营等场景,确保数据不出端。

所属事件:NVIDIA发布Nemotron 3.5 Lightning模型与NeMo Switchyard路由库(37 条相关)→

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →