NVIDIA Nemotron 3.5模型上线Crusoe,主打高并发智能体推理
Scobleizer · x · 2026-08-11
Crusoe 宣布在其托管推理服务平台上线 NVIDIA Nemotron 3.5 Lightning 模型。该模型为 30B 参数的 MoE 架构,激活参数仅 3B,专为处理智能体工作流中高频、特定的任务设计,兼顾速度与效率。
Crusoe 平台提供 Serverless 和自托管等多种部署选项,并采用 MemoryAlloy 技术优化集群内存路由,以降低延迟并提升吞吐量。
「Infra」频道最新
- Ling-3.0-flash 量化实测:MoE 架构让解码速度几乎无损 — AcanthisittaOk1699 · 2026-08-12
- NVIDIA 路由库实测:编码智能体成本降 59%、耗时减 32% — sudoraohacker · 2026-08-12
- SD视频生成优化实测:CK加速使耗时大降,但提示词遵循变差 — switch2stock · 2026-08-12
- M4 Max 浏览器跑 30B 模型达 25 tok/s,自定义 WebGPU 内核立功 — xenovatech · 2026-08-12
- 开发者询问OpenAI:能否用自家地下室GPU运行ML实验? — daniel_mac8 · 2026-08-12
- LMSYS发布统一Radix缓存:混合模型前缀缓存新方案 — ying11231 · 2026-08-12