Google 开源 EmbeddingGemma 2:740M 多模态嵌入模型仅占 0.5GB 内存
gnukeith · x · 2026-10-07
Google DeepMind 发布 EmbeddingGemma 2,其首个原生多模态端侧开源嵌入模型:740M 参数,Apache 2.0 许可,将文本(含代码)、图像(170M)、音频(300M)与视频统一映射到同一 768 维嵌入空间,支持 100+ 语言,可在仅 0.5GB 内存的设备上本地运行。Unsloth 已提供 GGUF 量化版本和本地运行/训练指南。
要点:
- 总参数 740M(文本 270M + 视觉 170M + 音频 300M)
- 一个共享向量空间覆盖代码、图像、音频、视频
- 端侧友好:0.5GB RAM 即可本地跑
- 模型卡含 768 维整体评测与向量截断评测结果
所属事件:谷歌开源 EmbeddingGemma 2 多模态嵌入模型(33 条相关)→
「模型」频道最新
- ChatGPT 传闻取消免费用户文字聊天上限并升级默认模型 — hey_abusiddik · 2026-10-07
- 5060 Ti 16GB 跑 Qwen3.8 Flash Next IQ1_M:55 tok/s 还能写出像样落地页 — bobaburger · 2026-10-07
- EmbeddingGemma 2 手机端离线跑多模态 RAG,文本仅占 191MB 内存 — Saboo_Shubham_ · 2026-10-07
- Paradigm 发布数学推理模型:7 项高难基准评测套件全开源 — tensorqt · 2026-10-07
- Limite 1B 借鉴 nanogpt speedrun 架构,用 NorMuon 训练 — tensorqt · 2026-10-07
- 1B 小模型 AIME 2026 考 94 分,Paradigma 开源 Limite 1B Violetto — tensorqt · 2026-10-07