文本一查全模态:EmbeddingGemma 2 用同一向量空间检索图音视频
tomaarsen · x · 2026-10-07
EmbeddingGemma 2 中文本查询可直接检索照片、录音或视频片段——所有模态都被映射到同一稠密向量空间。在 Sentence Transformers 里仍是熟悉的 model.encode() 与 model.similarity() API,模型卡附带简短的文本检索 quickstart。
所属事件:谷歌开源 EmbeddingGemma 2 多模态嵌入模型(33 条相关)→
「模型」频道最新
- Paradigm 从零训练数学模型 Limite 1B-Violetto 并发布技术报告 — tensorqt · 2026-10-07
- ChatGPT 传闻取消免费用户文字聊天上限并升级默认模型 — hey_abusiddik · 2026-10-07
- 5060 Ti 16GB 跑 Qwen3.8 Flash Next IQ1_M:55 tok/s 还能写出像样落地页 — bobaburger · 2026-10-07
- EmbeddingGemma 2 手机端离线跑多模态 RAG,文本仅占 191MB 内存 — Saboo_Shubham_ · 2026-10-07
- Paradigm 发布数学推理模型:7 项高难基准评测套件全开源 — tensorqt · 2026-10-07
- Limite 1B 借鉴 nanogpt speedrun 架构,用 NorMuon 训练 — tensorqt · 2026-10-07