论文揭示VLM无图也能答题,多模态评测分数普遍虚高

ziv_ravid · x · 2026-07-04

研究者zivravid发表"Mirage Probes"论文,发现视觉语言模型(VLM)在未附图像的情况下仍能正确回答图像问题,这一"幻觉镜像"效应(Asadi et al.)导致多模态基准测试分数被系统性高估。论文探究了这一现象的成因机制,对如何更准确地评估VLM真实视觉理解能力具有重要意义,揭示了当前多模态评测体系中的潜在偏差。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →