Google 开源 EmbeddingGemma 2:740M 参数多模态嵌入模型,全本地语义搜索
lmoroney · x · 2026-10-07
Google 发布 EmbeddingGemma 2,一个 740M 参数的嵌入模型,基于 Gemma 4 构建,采用 Apache 2.0 许可,可将文本、代码、图像、音频和视频映射到同一向量空间,实现文本查询直接检索视频片段或语音备忘录,全程无需上传云端。
要点:
- 模块化设计:纯文本场景最小只需 270M 参数,视觉编码器(170M)与音频编码器(300M)可选
- 向量维度可从 768 截断至 512/256/128 以压缩存储
- 量化后在 Pixel 11 Pro 上文本任务活跃内存约 191MB,完整多模态版约 567MB
- 上下文窗口扩展到 8K tokens,是初版的 4 倍
作者建议:已在跑本地 RAG 的用户,可分别用 768 与 256 维对自建文档做嵌入采样,对比检索质量后再定维度。
所属事件:谷歌开源 EmbeddingGemma 2:740M 参数多模态端侧嵌入模型(52 条相关)→
「Infra」频道最新
- 开源 Ramjet 亮相:本地多 GPU 推理编排,对标 NVIDIA Dynamo — DoggoProfessor959 · 2026-10-07
- NVIDIA NeMo-DCR:万亿参数 RL 权重同步提速 12-40 倍 — nvidia · 2026-10-07
- Qwen3.8 Flash Next IQ3_S 量化版实测:基本无损且省内存 — lxfater · 2026-10-07
- 二手 PS5 Pro 卖到 1399 美元,AI 数据中心与玩家抢内存 — aakashgupta · 2026-10-07
- 马斯克放话:Terafab 芯片厂将完全自建自营,TSMC 至多转租一部分 — MickeySteamboat · 2026-10-07
- 用 3.8% 的 GPU 跑出 72% 的智能?Mistral 计算效率引热议 — cyb3rops · 2026-10-07