阿里发布 Ovis-Embedding:全模态统一向量,刷新五大榜单 SOTA
_reachsumit · x · 2026-09-23
阿里巴巴发布 Ovis-Embedding 全模态向量模型家族,用共享多模态主干将文本、图像、视频、音频编码到同一表示空间,在 MMEB-v3、MMEB-v2、MVEB、MAEB、RTEB 等基准上取得 SOTA。三大技术要点:
- 原生全模态初始化:以预训练 Qwen-omni 为主干,低秩初始化后做对比训练
- 数据为中心的训练:构建覆盖五类模态的高质量语料,引入同源采样构造任务一致 batch 与高质量 in-batch 负例
- 嵌入专用优化:focal loss 强调难例,基于相似度的嵌入蒸馏迁移细粒度相似结构;推理时用低秩特征分解支持灵活维度、几乎无损
论文与代码均已公开。
所属事件:阿里发布 Ovis-Embedding 全模态嵌入模型刷新多项 SOTA(2 条相关)→
「模型」频道最新
- 数学界发公开信要求 OpenAI 公开其模型解决的 100 多个数学习题的证明 — panickssery · 2026-09-23
- 用 steering 向量实现 loom:从 n 条补全中提取并引导模型输出 — repligate · 2026-09-23
- 博主们囤多个订阅测模型,企业用户:这根本不是真实使用场景 — emaayan · 2026-09-23
- V4.1 预训练规模远超 V2.6 却差距存疑,DeepSeek 的 RL 是否真行遭质疑 — teortaxesTex · 2026-09-23
- GPT-6 Sol/Luna 现身 Codex CLI 却缺席扩展版,Plus 用户困惑 — nambirseyr · 2026-09-23
- 基于 Llama 3.1 70B 打造无助手数据的角色模型 computer-10 — liminal_bardo · 2026-09-23