LLM裁判存在分数区间偏差
xennygrimmato_ · x · 2026-07-15
这篇 ACL 论文讨论了 LLM-as-a-Judge 的一个新偏差:分数区间偏差(score range bias)。
核心发现
- 当给裁判模型的评分区间做等价平移时,比如 1-5 改成 2-6,模型对人类判断的相关性会系统性变化。
- 这种变化与被评内容本身无关,说明裁判模型存在此前未被充分记录的评估失真。
- 该现象在不同模型家族中都能观察到,包括 Llama-3 和 Qwen2.5,并且跨参数规模都成立。
论文思路
作者提出用 contrastive decoding 来缓解这种偏差。
这条帖文转述的是 PatronusAI 在 ACL 2026 上的论文发布,指向的是评测方法本身的可靠性问题,而不是某个单独模型的榜单成绩。
「研究」频道最新
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- VidMap 用 RoMa 粗匹配全帧、精细匹配仅限关键帧 — ducha_aiki · 2026-09-11
- Bug Hunt Bench 作者补充:榜单噪声幅度约 2-3 分 — PawelHuryn · 2026-09-11
- 台球计算模型登 PNAS:二维系统已存在不可判定性,可跑通用计算机 — eigensteve · 2026-09-11
- 新研究:从仿射变换与重力线索求解绝对位姿 — ducha_aiki · 2026-09-11