MMOOC 基准测试:多模态大模型难以平衡上下文与拒答能力

VCLab-HKPU · hf · 2026-08-11

MMOOC 是一个用于评估多模态大语言模型(MLLM)上下文外(Out-of-Context)表现的大规模基准测试。

该基准旨在检验模型是否能在正确回答上下文偏移问题的同时,拒绝回答脱离上下文的问题。研究发现,当前的模型在平衡这两种能力方面存在明显困难。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →