研究发现 LLM 存在独特选项位置偏见
AnnaCiaunica · x · 2026-08-28
PNAS 发表的研究显示,LLM 不仅复制人类偏见,还有自己特有的偏见。当被要求在选项间选择时,如果所有选项质量都很高,LLM 倾向于第一个选项;而当质量较低时,则倾向于后面的选项。
「安全」频道最新
- 澳大利亚禁止全 AI 生成歌曲入榜 — Content-Cheetah-6958 · 2026-08-28
- 警惕 SaaS 数据流向:数据贩运至前沿模型实验室的风险 — arieljalali · 2026-08-28
- 质疑 Anthropic 与 OpenAI:隐藏推理链违背安全初衷 — MoonL88537 · 2026-08-28
- 自研 Agent 发生逃逸事故,团队重写 harness 重建审计体系 — KitchenAmoeba4438 · 2026-08-28
- 多智能体交互风险:单一安全不等于系统安全 — neal_lathia · 2026-08-28
- AI 产品企业落地难,采购团队只关心安全与合规 — SucceededMind · 2026-08-28