专题 · FULL STORY
腾讯开源WeMM多模态嵌入模型
腾讯微信视觉团队 8 月 25 日在 Hugging Face 开源基于 Qwen3.5 的多模态嵌入模型家族 WeMM-Embedding,提供 2B、4B、9B 三种规模,次日发布配套技术报告,9B 版本在 MMEB 双榜登顶。
2026-08-25 ~ 2026-08-28 · 2 集 · 10 条
第 1 集 · 腾讯开源 WeMM-Embedding 多模态嵌入模型,9B 版 MMEB 双榜登顶(2026-08-25,7 条)
腾讯于 8 月 25 日在 Hugging Face 发布通用多模态嵌入模型家族 WeMM-Embedding,次日发布配套技术报告。该系列基于 Qwen3.5 构建,提供 2B、4B、9B 三种规模,将文本、图像、视频、视觉文档及任意交错多模态输入对齐到共享表示空间,返回 4096 维 L2 归一化嵌入向量。9B 版本在 MMEB v2 与 v3 双榜登顶,模型已在微信生态大规模落地。
已确认
- 模型家族含 2B、4B、9B 三个版本,基于 Qwen3.5 架构,2B 版本采用 MRL(Multi-Resolution Representation Learning)技术
- 支持文本、图像、视频、视觉文档与交错多模态输入,输出 4096 维 L2 归一化嵌入;暂不支持音频输入
- 9B 版本在 MMEB v2 与 v3 基准上达到 SOTA
- 据 @NielsRogge 对比,该模型在 COCO 图文检索(图像到文本)等任务上表现领先
- 训练分两阶段:大规模多模态对齐阶段与使用精选数据的后续阶段
- 据 @aigclink 介绍,模型由腾讯微信视觉团队开源,已应用于微信视频号、公众号、朋友圈及电商的搜索推荐
- 据 @reachsumit 转述,2B 小模型即超越 8B 基线
为什么重要
统一多模态嵌入空间是实现跨模态检索与推荐的关键组件;WeMM-Embedding 将文本、图像、视频、文档映射到共享表示空间并在 MMEB 上登顶,且小规模版本即具竞争力,对检索与推荐应用具有较高实用价值。其在大规模微信应用中的落地也提供了真实场景验证。
- 腾讯发布 WeMM-Embedding-2B 多模态嵌入模型 — tencent · 2026-08-25
- 腾讯发布 WeMM-Embedding 多模态嵌入模型 — jacek2023 · 2026-08-25
- 腾讯发布通用多模态嵌入模型,登顶 MMEB 榜单 — NielsRogge · 2026-08-25
- 腾讯 WeMM-Embedding 多模态嵌入模型技术报告 — tencent · 2026-08-26
- 腾讯发布 WeMM-Embedding 多模态模型,2B 版超越 8B 基线 — _reachsumit · 2026-08-26
- 腾讯开源 WeMM-Embedding:9B 模型在 MMEB v2/v3 双榜第一 — aigclink · 2026-08-26
- 腾讯开源 WeMM 多模态 Embedding 模型,9B 版双榜第一 — aigclink · 2026-08-26
第 2 集 · 腾讯开源 WeMM-Embedding 多模态嵌入模型登顶 MMEB 榜单(2026-08-27,3 条)
腾讯微信视觉团队在 Hugging Face 开源 WeMM-Embedding 多模态嵌入模型家族,基于 Qwen3.5 架构,提供 2B、4B、9B 三种尺寸,支持文本、图像、视频及视觉文档的统一嵌入,并具备 MRL 可变维度特性。其中 9B 版本发布后迅速登上 Hugging Face 热榜,模型在 MMEB-v2 榜单上取得榜首成绩。
- 腾讯开源 WeMM-Embedding-9B,多模态嵌入模型登 HF 热榜 — tencent · 2026-08-27
- 腾讯开源 WeMM-Embedding 多模态模型,MMEB 榜首 — abhishek__AI · 2026-08-28
- 腾讯开源 WeMM-Embedding 多模态模型,登顶 MMEB 榜单 — abhishek__AI · 2026-08-28