Google 发布 EmbeddingGemma 2:740M 参数、文本图像音视频统一向量空间
Recoil42 · reddit · 2026-10-07
Google DeepMind 发布开源多模态 embedding 模型 EmbeddingGemma 2,将文本(含代码)、图像、视频、音频及其组合映射到同一个 768 维向量空间。模型总参数 740M,由 270M 文本模型加 170M 视觉、300M 音频模块化编码器组成。设计目标是跑在手机、笔记本等消费级硬件上,面向端侧搜索、RAG、分类和聚类等低延迟语义检索场景。
所属事件:谷歌开源 EmbeddingGemma 2 多模态端侧嵌入模型(37 条相关)→
「模型」频道最新
- Mistral 新模型 Le Chonk 盲测登顶:开源编程模型第一,总榜仅次 Opus 5 — qtnx_ · 2026-10-07
- DeepSeek V4.1 Flash 登 ARC-AGI-2 72.9%,单任务成本涨 250% — teortaxesTex · 2026-10-07
- Mistral 宣称 Large 4 是全球最强网络安全 AI 模型之一 — scaling01 · 2026-10-07
- Mistral Large 4 实测 19 道 CTF 题,工具调用解开 18 道 — MistralAI · 2026-10-07
- 社区给 AI 实验室分层:Anthropic/OpenAI 居前沿,Mistral 被评落后三代 — NathanpmYoung · 2026-10-07
- 用户吐槽 Opus 通宵跑图,仅 2 小时即撞上用量上限 — Sauers_ · 2026-10-07