OPD-V:利用模态平衡作为特权信息优化视觉推理

Aniri · hf · 2026-08-06

现有多模态大模型(MLLM)的视觉推理常受“模态不平衡”困扰,导致文本信息主导生成,视觉特征被忽略。本文提出 OPD-V,一种视觉在策略自蒸馏(OPSD)新范式。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →