NVIDIA 发布新嵌入模型并大幅提分
tomaarsen · x · 2026-07-17
NVIDIA 的 Nemotron-3-Embed-1B 采用了一个比较少见的压缩流程:先从 3B parent 通过 NVIDIA ModelOpt 做 NAS 剪枝到 2B,再用 8B teacher 通过 cosine + MSE loss 蒸馏,最后重复这一过程得到 1.14B。
作者还给出了检索评测结果:在 RTEB 16 个任务上,Nemotron-3-Embed-8B 的平均 NDCG@10 为 78.46,1B 为 72.38;同尺寸上一代 llama-nemotron-embed-1b-v2 只有 60.47,说明 1B 相比前代提升了 11.9 分。MMTEB Retrieval 上也有类似提升(71.04 vs 59.58)。
所属事件:NVIDIA 发布 Nemotron-3-Embed 系列(11 条相关)→
「模型」频道最新
- Agent Astra 在 GauntletBench 得 83%,成首个超人类基线的电脑操作 Agent — ducha_aiki · 2026-09-11
- Kimi K2.8 Preview 上线:性能接近 K3、1M 上下文全档开放 — teortaxesTex · 2026-09-11
- 有人想给软件工程任务建「形态分类」数据库,好按任务选模型 — StewartalsopIII · 2026-09-11
- 用户呼声下 DeepSeek V4 Pro API 宣布继续服务,计费不变 — teortaxesTex · 2026-09-11
- 第三方实测:DeepSeek V4.1 Flash 达 GPT-6 Astra 98% 分,成本仅 1.4% — ayushtweetshere · 2026-09-11
- TheZhi 发起调查:Fable 5.1 与 Astra 发布后,编码模型选择变了吗 — TheZvi · 2026-09-11