新基准 SciFigPlag-Bench 挑战 LLM 检测图表剽窃能力

anshulkundaje · x · 2026-08-19

前沿 LLM 仍未解决学术期刊中重复图表的检测问题,这是一个极具挑战性的计算任务,尤其是当重复图表跨越多篇文章时。为此,研究人员发布了新基准 SciFigPlag-Bench。该基准包含 2582 对正样本和 2541 对负样本,支持成对检测、来源归属、复用类型分类和定位等任务。实验表明,现有模型在细粒度的溯源推理和空间对应方面仍面临 persistent 挑战。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →