LightOn 推出 NeoMME:原生多模态编码器,260M/800M 无视觉塔
antoine_chaffin · x · 2026-09-03
LightOn 团队发布 NeoMME:不走「生成式大 VLM 当表征模型」的常规路线,而是从零训练原生支持文本与图像的编码器,多语言、天生追求速度,参数量仅 260M 和 800M,且没有视觉塔(vision tower)。
- 主张:许多表征模型仍基于庞大的生成式 VLM,架构效率不高;从零训练的编码器证明可以做得更快更高效
- 同时在 NeoMME 之上微调出视觉文档检索器 NeoMME-Retriever
- 由 LightOn 校友 Aurelien Lemonier 主导,作为对「多模态 ModernBERT」构想的实践回应
所属事件:LightOn 发布 NeoMME 单塔多模态编码器,小参数量领跑检索(3 条相关)→
「多模态」频道最新
- Topaz 视频增强搬进浏览器:放大、插帧、SDR 转 HDR 免装应用 — umesh_ai · 2026-09-03
- Topaz Web 浏览器端视频增强实测:超分、慢动作、SDR 转 HDR — umesh_ai · 2026-09-03
- ComfyUI 浏览器端跑重视频工作流频繁崩溃,作者迁移至桌面端 — Suspicious_Pizza9529 · 2026-09-03
- Seedance 2.5 复刻快银名场面,视频生成再秀肌肉 — bennash · 2026-09-03
- AI 一镜到底 30 秒穿越阿尔及利亚:从卡斯巴哈到撒哈拉星空 — azed_ai · 2026-09-03
- 作者用 MiniMax H3 为 Suno AI 音乐制作 MV 实测 — Velkan1642 · 2026-09-03