Ai2 发布 BenchMIRT 审计 LLM 基准,揭露 BBQ 实测推理而非偏见

allen_ai · x · 2026-09-02

Ai2 发布 BenchMIRT,一种基于项目反应理论(IRT)的新方法,用于审计 LLM 基准测试,分析单个问题实际测量的模型能力。

研究发现,旨在测试社会偏见的 BBQ 基准,其题目实际上更多是在区分模型的推理能力而非安全性。该方法有助于区分基准分数背后的信号,避免因平均分数掩盖模型在不同能力维度上的真实表现。

所属事件:Ai2 开源 BenchMIRT 审计 LLM 基准测试(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →