NeurIPS 论文揭示 LLM 权威偏差:一句「已验证信源」就能让模型改口

paraschopra · x · 2026-10-01

LossFunc 团队发布新论文(已被 NeurIPS 2026 接收),提出 Authority Bias(权威偏差) 概念:

作者 Paras Chopra 强调其现实影响:如果模型在线检索到的网页只是自称来自已验证信源,就可能左右模型的回答——这对 RAG/搜索增强场景的可信性是一个实质风险。

所属事件:NeurIPS 论文揭示大模型权威偏差:一句「已验证信源」可翻转模型答案(2 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →