NVIDIA放出高性能Embedding模型

soumitrashukla9 · x · 2026-07-17

帖文称,NVIDIA 在 RTEB 上拿到了很强的 embedding 成绩,而且直接放出了 open weights。

作者最兴奋的是 1B 的 NVFP4 版本:按帖子说法,连同 kv 和 CUDA 开销在内,很多场景下体积都能控制在 2GB 以下,适合本地部署。帖子还强调,高质量 embedding 是本地搜索、RAG 和“和你的资料对话”体验的基础;如果检索弱,再聪明的语言模型也很难救回来。

所属事件:NVIDIA 发布 Nemotron-3-Embed 系列(11 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →