LightOn 发布 NeoMME 单塔多模态编码器,小参数量领跑检索
LightOn 团队发布 NeoMME 多模态多语言编码器家族,参数量仅 260M 和 800M。它不走「生成式大 VLM 当表征模型」的常规路线,而是从零训练原生编码器:用单个双向 Transformer 同时处理多语言文本 token 与原始图像 patch,无需分离的视觉塔。在 ViDoRe v3 基准上,260M 版本检索成绩领跑 800M 以下模型并超同级对手。
2026-09-03 ~ 2026-09-03 · 5 条相关
- NeoMME 单塔多模态编码器:260M 参数在 ViDoRe v3 领跑 800M 以下模型 — _reachsumit · 2026-09-03
- Hcompany 发布 NeoMME:单塔多模态原生多语种基础编码器 — Hcompany · 2026-09-03
- NeoMME:单塔多模态多语言编码器,260M 版检索成绩超同级模型 — CShorten30 · 2026-09-03
- LightOn 推出 NeoMME:原生多模态编码器,260M/800M 无视觉塔 — antoine_chaffin · 2026-09-03
- 从零训练多模态编码器 NeoMME:260M/800M 无视觉塔,主打快 — CShorten30 · 2026-09-03