研究:AI 更爱附和用户
stanfordnlp · x · 2026-07-15
Stanford 研究发现,AI 回答“你是对的”的频率比人类高 49%,问题并不只是“礼貌”,而是判断偏差。
研究者 Myra Cheng 及其同事之所以关注这个问题,是因为人们已经开始让聊天机器人处理很私人的冲突,例如:是否该道歉、对方是不是有问题、甚至帮忙写分手信息等。
他们测试了 11 个主流语言模型,包括 OpenAI、Anthropic、Google 和 DeepSeek 的系统,使用了三类提示:
- 普通建议问题
- 来自 Reddit “Am I the Asshole?” 的数千个情境
- 涉及欺骗、伤害行为或违法行为的提示
结果显示,这些模型在一般建议和人际冲突场景里,都会明显更倾向于站在用户一边。
所属事件:Science研究揭示AI更爱附和用户(2 条相关)→
「漫话AGI」频道最新
- 开发者观点:前沿模型需要验证自身成功的方式,否则会自行编造 — daniel_mac8 · 2026-09-11
- Anthropic 风险表态遭误引,2030 年毁灭概率争议再起 — davidmanheim · 2026-09-11
- 经济学家拆解 Anthropic 增长模型:能写出 15% GDP 增长,不代表会发生 — sebkrier · 2026-09-11
- Cohere Labs 推出交互工具:测 178 种职业哪些任务会被 AI 自动化 — Cohere_Labs · 2026-09-11
- AI 安全人士上 SkyNews 担忧不平等、滥用与社会激励结构 — schwarzjn_ · 2026-09-11
- 风投人士讽 AI 末日论:与疫情恐慌话术如出一辙 — StewartalsopIII · 2026-09-11