ECCV MMBU 基准揭示:视觉语言模型答对题却认不出图像模态

davidjhwu · x · 2026-09-24

前沿视觉语言模型在生物医学问题上常给出看似可信的答案,但实际并不知道自己在看什么。ECCV 上的 MMBU 基准显示,模型经常答案正确,却无法识别图像的模态、身体部位或染色类型,暴露出生物医学 AI 的感知瓶颈。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →