PRIME评测:LLM推理是否依赖社会刻板印象

mdredze · x · 2026-07-03

研究提出 PRIME 评测基准,探究大语言模型是否在逻辑推理过程中将社会刻板印象当作认知捷径,并对其行为进行系统评估。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →