一类实证AI论文:只报LLM偏见却不比人类偏见
JeremyNguyenPhD · x · 2026-07-04
作者指出当下存在一类实证AI论文:只报告LLM在某种偏见上的表现,却不说明人类的同类偏见通常被测得更高,结果标题却渲染成“AI偏见惊人”。这是对LLM偏见评测方法论选择与叙事偏差的批评。
「研究」频道最新
- 一万个智能体能否突破反向传播,找到更好的学习算法 — SeunghyunSEO7 · 2026-09-11
- Cognition SWE-2 用 KKT 对偶优化长度惩罚,一次 RL 推移 Pareto 曲线 — YouJiacheng · 2026-09-11
- VidMap 用 RoMa 粗匹配全帧、精细匹配仅限关键帧 — ducha_aiki · 2026-09-11
- Bug Hunt Bench 作者补充:榜单噪声幅度约 2-3 分 — PawelHuryn · 2026-09-11
- 台球计算模型登 PNAS:二维系统已存在不可判定性,可跑通用计算机 — eigensteve · 2026-09-11
- 新研究:从仿射变换与重力线索求解绝对位姿 — ducha_aiki · 2026-09-11