腾讯发布通用多模态嵌入模型,登顶 MMEB 榜单
NielsRogge · x · 2026-08-25
腾讯在 Hugging Face 上发布了一个通用多模态嵌入模型,可将文本、图像、视频与视觉文档映射到同一表示空间,在 MMEB v2 与 v3 上达到 SOTA。
据 Niels Rogge 对比,该模型在 COCO 图文检索(image-to-text retrieval)上还击败了 Meta 上周刚发布的 MoE 视觉模型,登顶 Papers with Code 榜单。
「模型」频道最新
- MiniMax H3 推理引擎 h3.c 开源,支持 Mac 与 3090 — QuixiAI · 2026-08-25
- 实测发现 ChatGPT 仍在按名搜索特定 Subreddit — gaganghotra_ · 2026-08-25
- LLM 用久了会发现:记忆功能常帮倒忙,遗忘或是最优解 — sebpaquet · 2026-08-25
- 疑似智谱 GLM 5.3 Flash 版本界面曝光 — LegacyRemaster · 2026-08-25
- 研究显示 LLM 技能与语言相关,英语推理可恢复性能 — LChoshen · 2026-08-25
- Qwen3.8 27B 动态量化版不再输出“原始人思维” — Glad_Claim_6287 · 2026-08-25