Meta 提出 MoEMB:3B 激活参数超越 4 倍规模的多模态嵌入模型
_reachsumit · x · 2026-09-09
Meta 等机构发布论文 MoEMB,提出用混合专家(MoE)扩展通用多模态嵌入模型,而非增大表示维度、检索开销或堆成重型多模态 LLM。
- 动机:嵌入模型难以规模化——参数增大与对比学习所需的大 batch 冲突,且检索服务受延迟约束;不同任务复杂度差异大,整体扩容带来大量冗余计算。
- 方法:沿专家维度扩展编码器容量,同时保持单向量、非自回归编码,并系统研究 MoE 嵌入的设计空间与训练配方。
- 结果:在基于公开 MMEB 系列数据训练的模型中,仅 3B 激活参数即在 MMEB-V2 和 MRMR 上刷新 SOTA,超越激活参数 4 倍以上的推理式嵌入方法(TTE),计算量显著更低。
- 另对自适应计算做了首个系统研究以进一步提升效率。
「多模态」频道最新
- 五款模型接力:Reddit 用户全 AI 流程产出完整视频 — CQDSN · 2026-09-09
- Minimax H3 视频疑似压缩糊:1440p 输出像 720p YouTube — FoxTrotte · 2026-09-09
- Mage 上线 MiniMax H3 视频模型,支持不限量生成 — MiniMax_AI · 2026-09-09
- GPT Image 2.5 实测:一句 prompt 出片,咖啡馆 iPhone 风照片几可乱真 — Scobleizer · 2026-09-09
- Flux 2 Klein 9B 新 LoRA:红点标注即可精确控制画面眼神方向 — Euphoric_Attorney271 · 2026-09-09
- 四个「想象 token」实验:Empireghost、Recallfog 等让 Midjourney 生成概念化图像 — LudovicCreator · 2026-09-09