SetwiseEvalKit 评估的是文档集合而非单篇结果

Kailin Jiang · hf · 2026-07-23

这篇论文在解决什么

作者认为,当 LLM 和 AI agents 直接消费搜索结果时,真正决定下游生成质量的,不是单篇文档相关性,而是整个文档集合的质量。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →