LightOn 发布 NeoMME 单塔多模态编码器,小参数量领跑检索

LightOn 团队发布 NeoMME 多模态多语言编码器家族,参数量仅 260M 和 800M。它不走「生成式大 VLM 当表征模型」的常规路线,而是从零训练原生编码器:用单个双向 Transformer 同时处理多语言文本 token 与原始图像 patch,无需分离的视觉塔。在 ViDoRe v3 基准上,260M 版本检索成绩领跑 800M 以下模型并超同级对手。

2026-09-03 ~ 2026-09-03 · 5 条相关