字节发布抖音多模态嵌入模型,已上线搜索业务

ByteDance · hf · 2026-08-10

字节跳动发布抖音多模态嵌入模型(DME)技术报告。该模型采用两阶段训练:大规模对比预训练构建统一多模态嵌入空间,随后通过隐空间推理与交叉重构补充细粒度语义。

这种设计在推理时几乎不增加额外开销。在 MMEB-v2 基准测试中,DME 的 2B 和 9B 版本均达到同规模最优。目前该模型已部署于抖音的生成式、图像及 AI 搜索场景,线上 A/B 测试显示其带来了 0.1% 的生命周期收益提升。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →