H 公司开源 Apache 2.0 嵌入模型,附长文档向量池化省算力技巧

tomaarsen · x · 2026-09-07

sentence-transformers 维护者 tomaarsen 转发并介绍了 H Company(@hcompanyai)新发布的两个嵌入模型,均为 Apache 2.0 开源,官方博客详述了架构、训练与检索结果。

配套实用技巧:页面图像类文档会产生大量 patch 向量,在 sentence-transformers 中可用 HierarchicalTokenPooling 对文档向量做层级聚类、保留簇均值;poolfactor=2 约可砍掉一半文档向量,而查询向量保持不变。作者建议在自己的数据上实测质量与成本的权衡。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →