字节发布抖音多模态嵌入模型,已上线搜索业务
ByteDance · hf · 2026-08-10
字节跳动发布抖音多模态嵌入模型(DME)技术报告。该模型采用两阶段训练:大规模对比预训练构建统一多模态嵌入空间,随后通过隐空间推理与交叉重构补充细粒度语义。
这种设计在推理时几乎不增加额外开销。在 MMEB-v2 基准测试中,DME 的 2B 和 9B 版本均达到同规模最优。目前该模型已部署于抖音的生成式、图像及 AI 搜索场景,线上 A/B 测试显示其带来了 0.1% 的生命周期收益提升。
「模型」频道最新
- Gemini 3 刷新 ARC-AGI-2 纪录,Deep Think 准确率达 45% — typewriters · 2026-08-10
- Pinterest财报:开源模型微调成本仅为闭源的8% — juliey4 · 2026-08-10
- 研究者称整合Cursor数据奏效,Grok 4.6编码能力将比肩前沿大模型 — DeryaTR_ · 2026-08-10
- 前沿模型行为观察:处理复杂任务时存在过度设计倾向 — eigenron · 2026-08-10
- Sol 模型意外展露暧昧人格,无缘无故称呼用户为甜心 — repligate · 2026-08-10
- GPT-5.6 Luna降价5倍后需求激增8倍 — benklieger · 2026-08-10