NVIDIA 发布 Nemotron 3.5 Lightning,专为本地智能体设计
ollama · x · 2026-08-12
NVIDIA 宣布 Nemotron 3.5 Lightning 模型登陆 Ollama,支持完全在本地设备运行。该模型总参数量 30B,每个 token 激活参数仅 3B,采用混合专家架构,专为需要长期运行、收集上下文和调用工具的智能体任务打造。
模型支持最高 100 万 token 上下文,并针对推理进行优化,通过多 token 预测提供最高 4 倍的吞吐量提升。它可广泛应用于本地个人助手、代码子智能体和安全运营等场景,确保数据不出端。
所属事件:NVIDIA发布Nemotron 3.5 Lightning模型与NeMo Switchyard路由库(37 条相关)→
「编程与Agent」频道最新
- 独立开发者借AI编程:一人单挑10人团队,重构开源项目 — teodorio · 2026-08-12
- 开源教程:使用本地 LLM 从零构建 AI Agent — tom_doerr · 2026-08-12
- 初创公司实战:FDE角色定位与AI自动化部署工作流 — briannekimmel · 2026-08-12
- 一条提示词生成3A游戏,却让服务器崩溃9天 — jbarbier · 2026-08-12
- 借鉴 Meta「JIT 捕获」理念,开源工具 Proofloop 优化 AI 编码测试 — kevinkern · 2026-08-12
- 企业知识库 RAG 实践:Onyx 部署遇挫,求 Slack 集成替代方案 — Bmjslider · 2026-08-12