新基准 ENTRAP-VL:精准测度视觉语言模型的上下文误导效应

Karan Goyal · hf · 2026-07-24

研究团队推出了 ENTRAP-VL(视觉与语言上下文带动效应评估探针),这是一个用于评估视觉语言模型(VLM)的新基准。

核心概念:上下文带动效应是指模型的输出会被输入中的辅助上下文牵引,而不论该上下文是否相关、真实或有意义。此前该现象仅在纯文本模型中被研究。

研究贡献:

该工具旨在帮助社区更严谨地研究 VLM 的上下文误导问题,数据集将公开发布。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →