NVIDIA发布Nemotron 3.5 Lightning:30B参数仅激活3B,专为Agent执行层设计
heyshrutimishra · x · 2026-08-11
NVIDIA 发布了 Nemotron 3.5 Lightning 模型,专为 AI agent 的执行层优化。
- 核心架构:30B 参数规模,采用 MoE 架构,每个 token 仅激活 3B 参数,以极低计算成本提供 30B 级别的能力。
- 设计理念:AI agent 90% 的时间在执行工具调用、结果验证等任务,不需要庞大的推理模型。Lightning 旨在以极低成本处理这些日常任务,让前沿大模型专注规划。
- 性能表现:在 PinchBench 上准确率达 86%;完成 10,000 个 agent 任务的速度比 Qwen3.6 35B 快 30%,且准确率相当。
- 部署特性:内置投机解码,支持 NVFP4 量化,同一检查点可跨 Blackwell、Hopper 和 Ampere 架构运行。
- 开源:采用 OpenMDW-1.1 协议,完全开放权重、数据和训练配方。
所属事件:英伟达开源Nemotron模型与Switchyard智能体路由工具(27 条相关)→
「编程与Agent」频道最新
- Nuphos:主打人工审批的AI原生DevOps平台 — JaynitMakwana · 2026-08-11
- 迁移Aider记录至本地记忆:开发者吐槽解析逻辑复杂 — SnooSquirrels4739 · 2026-08-11
- 实测Meta新模型Muse Glimmer:30B专为智能体优化 — altryne · 2026-08-11
- Grok多模态工作流实测:图像生成直通3D建模 — Daniel_Farinax · 2026-08-11
- 实测Invideo Agent Two:多智能体协作重塑视频创作流 — umesh_ai · 2026-08-11
- 尝试将Claude Skills与nb笔记管理结合构建任务工作流 — 4310sy · 2026-08-11