H Company 发布 NeoMME:260M 模型以 1/14 参数追平 ColQwen2.5 检索成绩
tomaarsen · x · 2026-09-07
H Company 开源 NeoMME,一组 260M/800M 的多语言多模态编码器,采用单塔双向 Transformer,文本 token 与原始图像 patch 从头联合训练(掩码离散扩散目标),不依赖预训练视觉塔或因果解码器,上下文 16,384 token。
关键点
- 基于 ColPali 页面图检索方案,可直接检索文档页(含图表),无需 OCR 步骤
- NeoMME-Retriever 单次前向同时输出 dense 与 late-interaction 两类向量,可先 dense 索引召回再用 late interaction 重排
- ViDoRe v3 上 260M 得 0.523 nDCG@10,与 3.75B 的 ColQwen2.5-v0.2(0.524)几乎持平,参数少约 14 倍;800M 达 0.556
- L40S 上 260M 每秒编码约 51 页,约为 ColModernVBERT 的 2 倍
- 层级 token 池化 + 非对称量化把 late-interaction 索引从约 1.5MB/页压到 6kB(255 倍),保留 95% 以上 nDCG@10
- Sentence Transformers 集成:MultiVectorEncoder 检索文档页;dense 检查点支持 Matryoshka 维度(1281792),可 truncatedim=256 缩向量;HierarchicalTokenPooling(poolfactor=2)可减半页面 patch 向量
- 同一检查点也支持跨语言纯文本文档检索,用 MeanMaxSim 打分
全部检查点以 Apache 2.0 开源,含技术报告与 Visual RAG demo。
所属事件:H Company 开源 NeoMME 多模态编码器,小模型追平 ColQwen2.5(2 条相关)→
「模型」频道最新
- 18 个月内智能单价暴跌约 1000 倍,新模型还更聪明 — ccerrato147 · 2026-09-07
- 博主称 Google Astra 说话不装腔,替代了最后一点 Claude 依赖 — StewartalsopIII · 2026-09-07
- 投资人讽前沿实验室订阅模式:高档模型用量将逐步紧缩 — StewartalsopIII · 2026-09-07
- GPT-6 Astra 一步生成精美数学动画,作者直呼前所未见 — omarsar0 · 2026-09-07
- giffmana 与 NandoDF 交锋:LLM 至今做不好实验设计 — giffmana · 2026-09-07
- 网友排定 AI 编程能力线:Claude 3.5 过中位数,Opus 4.5 达 SWE 均值 — menhguin · 2026-09-07