SIGNPOST-Bench:评估多模态大模型的图文冲突解决能力

Sirun Li · hf · 2026-08-07

研究团队推出了 SIGNPOST-Bench,这是一个用于评估多模态大语言模型(MLLM)在图文信息冲突时如何进行仲裁的基准测试。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →