NVIDIA 发布新嵌入模型并大幅提分

tomaarsen · x · 2026-07-17

NVIDIA 的 Nemotron-3-Embed-1B 采用了一个比较少见的压缩流程:先从 3B parent 通过 NVIDIA ModelOpt 做 NAS 剪枝到 2B,再用 8B teacher 通过 cosine + MSE loss 蒸馏,最后重复这一过程得到 1.14B。

作者还给出了检索评测结果:在 RTEB 16 个任务上,Nemotron-3-Embed-8B 的平均 NDCG@10 为 78.46,1B 为 72.38;同尺寸上一代 llama-nemotron-embed-1b-v2 只有 60.47,说明 1B 相比前代提升了 11.9 分。MMTEB Retrieval 上也有类似提升(71.04 vs 59.58)。

所属事件:NVIDIA 发布 Nemotron-3-Embed 系列(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →