研究显示 LLM 拥有独特偏好偏差,不仅复刻人类偏见

ValerioCapraro · x · 2026-08-28

研究发现 LLM 不仅复刻人类偏见,还展现出自身特有的偏差模式:

这些偏差并非无害的决胜手段。展示顺序的改变可能完全逆转模型的底层偏好,导致其选择原本认为较差的选项。这些特定的偏差在人类决策中尚未被记录,表明 LLM 可能并非人类偏好的简单镜像。

所属事件:研究称 LLM 存在位置与名称等独特偏好偏差(3 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →