新基准 SciFigPlag-Bench 挑战 LLM 检测图表剽窃能力
anshulkundaje · x · 2026-08-19
前沿 LLM 仍未解决学术期刊中重复图表的检测问题,这是一个极具挑战性的计算任务,尤其是当重复图表跨越多篇文章时。为此,研究人员发布了新基准 SciFigPlag-Bench。该基准包含 2582 对正样本和 2541 对负样本,支持成对检测、来源归属、复用类型分类和定位等任务。实验表明,现有模型在细粒度的溯源推理和空间对应方面仍面临 persistent 挑战。
「多模态」频道最新
- MiniMax H3 实测:生成城市上空巨鲸游走的超写实视频 — cocktailpeanut · 2026-08-19
- AI 艺术展示:GPT5.6 Sol Pro 生成自画像作品 — repligate · 2026-08-19
- Minimax H3 视频生成测试:混合剪辑 Zelda 素材 — dramaton42 · 2026-08-19
- Seele AI 推出 3D Agent,一键生成完整场景 — SimplyAnnisa · 2026-08-19
- MiniMax H3 ComfyUI 工作流更新:支持 1 分钟无缝长视频生成 — stonyleinchen · 2026-08-19
- HappyShrimp AI 音乐生成实测:人声清晰度胜过 Suno — MattVidPro · 2026-08-19