NVIDIA 发布多语嵌入模型

tomaarsen · x · 2026-07-17

NVIDIA 这次发布了新的 embedding 方案,并且原生集成到 Sentence Transformers 中,使用时可以直接加载 nvidia/Nemotron-3-Embed-8B-BF16,对 query 和 document 分别编码。

帖子还提到它支持 NVFP4 变体和 vLLM,保存了 prompts 与归一化元数据,query/passage 前缀会自动处理。作者的评价是:这是一个面向多语种 RAG 的很强发布,检索准确率看起来领先,1B 版本则更适合预算有限的团队。

所属事件:NVIDIA 发布 Nemotron-3-Embed 系列(11 条相关)→

原文链接 →

「Infra」频道最新

更多「Infra」频道 AI 资讯 →