Google EmbeddingGemma 2 模块化设计:按需加载编码器,最小仅 270M
HankYeomans · x · 2026-10-07
EmbeddingGemma 2 采用模块化架构,总参数约 740M,可拆分加载:文本 270M、视觉 170M、音频 300M。通过 configkwargs 可禁用不用的编码器——纯文本只加载 270M,文本+图像 440M,文本+音频 570M。这种按需加载设计专为手机和笔记本等端侧设备打造,只加载应用所需编码器即可运行。
所属事件:谷歌发布 EmbeddingGemma 2:首个端侧原生多模态开源嵌入模型(48 条相关)→
「Infra」频道最新
- NVFP4 让 2.4 万亿参数模型只用 1/4 GPU,单 token 成本最高降 73% — ryanshrout · 2026-10-07
- Intel 高管:agentic AI 大量时间耗在等待,关键指标是端到端时长 — ryanshrout · 2026-10-07
- 三台异构机器跑本地推理,如何统一服务与监控? — ziyaulhuk12 · 2026-10-07
- Beff Jezos:解耦推理是未来,异构算力云正当其时 — beffjezos · 2026-10-07
- 「拥有自己的 AI」在技术上到底意味着什么? — Imaginary_Choice_430 · 2026-10-07
- NVIDIA 发布 LoGRA:低秩梯度草图把 LLM 强化学习训练内存最高省 45.7% — nvidia · 2026-10-07