EmbeddingGemma 2 降维实测:128d 缩 6 倍但质量明显下降
tomaarsen · x · 2026-10-07
tomaarsen 实测 EmbeddingGemma 2 的 Matryoshka 截断维度:128d 向量缩小 6 倍,但 MMEB v2 总分从 768d 的 59.01 降至 45.65,质量取舍明显。模型卡建议 128d 仅用于纯文本负载;混合模态场景在 256d 质量影响小得多——存储只需三分之一,MTEB 多语言 v2 仅从 61.36 微降至 60.41。使用时在 Sentence Transformers 中设 truncatedim=256 并 normalizeembeddings=True,截断后需重新归一化。
「模型」频道最新
- llama.cpp 首日支持 EmbeddingGemma 2,gg 创作者亲自宣布 — ggerganov · 2026-10-07
- 网红实测:开源模型接入Agent编码器体验远逊Codex与Claude Code — MatthewBerman · 2026-10-07
- antirez 指出 DeepSeek v4.1 在 DeepSWE 上跑赢 Mistral Large 4 — antirez · 2026-10-07
- StartLux 自报:27B 模型在 38 项基准中 31 项领先 Jev AI — Dr_Singularity · 2026-10-07
- 24 个模型跑 669 项临床决策:Jev 居首,两款免费模型追平 — MaziyarPanahi · 2026-10-07
- EmbeddingGemma 2 禁用 FP16:激活超动态范围,会 NaN 或静默降质 — tomaarsen · 2026-10-07