SCOPD:剪枝仅留10%视觉token,VLM仍保92%性能

uoft · hf · 2026-09-29

多伦多大学团队发布 SCOPD(Sparse-Context On-Policy Self-Distillation),针对推理型 VLM 中视觉 token 剪枝导致的性能损失提出新解释与解法。

核心发现:表示-利用鸿沟

方法

结果

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →