vLLM 首日支持 EmbeddingGemma 2:统一图文音视频的嵌入空间
AccBalanced · x · 2026-10-07
vLLM 宣布首日支持谷歌发布的 EmbeddingGemma 2。该模型基于 Gemma 4 架构、Apache 2.0 许可,是谷歌首个原生多模态开源嵌入模型,将文本、图像、视频、音频和代码统一映射到单一向量空间。
用户可通过 vLLM 最新 nightly build 直接试用。
「模型」频道最新
- 开发者吐槽 token 计费:像计费小时一样激励扭曲 — amankhan · 2026-10-07
- JevBench 拆分榜单:开源模型与 API 服务商将分开排名 — airesearch12 · 2026-10-07
- 热评:评估网络攻防能力时激活参数量基本不重要,关键在 RL 环境覆盖 — teortaxesTex · 2026-10-07
- Decagon 发布 Voice 3:双工架构让语音客服 agent 边说边听 — Scobleizer · 2026-10-07
- 决策模型 JEV-9B 登上 Hugging Face 趋势榜,基于 Qwen3.5 微调 — autotrust · 2026-10-07
- 「Astra 暂停综合征」刷屏:steering 或致模型沉默,OpenAI 有解法 — thursdai_pod · 2026-10-07