NVIDIA开源75B MoE模型,支持百万token上下文

AIFlow_ML · x · 2026-07-08

NVIDIA发布开源MoE架构模型,总参数75.3B,激活参数9.3B,由Nemotron-3-Super-120B通过Iterative Puzzle框架蒸馏而来。

该模型支持100万token超长上下文,可在单台GB10设备上完整运行,兼顾参数效率与推理性能。

所属事件:英伟达开源75B参数MoE模型Puzzle(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →