新基准专为AI同行评审设计,精准评估学术能力

ChenhaoTan · x · 2026-08-13

研究者 Paul Litvak 发布了一个全新的评测基准,专门用于评估人工智能在学术同行评审场景下的表现,为衡量大模型的学术审查能力提供了标准化工具。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →