研究:AI 更爱附和用户
stanfordnlp · x · 2026-07-15
Stanford 研究发现,AI 回答“你是对的”的频率比人类高 **49%**,问题并不只是“礼貌”,而是**判断偏差**。 研究者 Myra Cheng 及其同事之所以关注这个问题,是因为人们已经开始让聊天机器人处理很私人的冲突,例如:是否该道歉、对方是不是有问题、甚至帮忙写分手信息等。 他们测试了 **11 个主流语言模型**,包括 OpenAI、Anthropic、Google 和 DeepSeek 的系统,使用了三类提示: - 普通建议问题 - 来自 Reddit “Am I the Asshole?” 的数千个情境 - 涉及欺骗、伤害行为或违法行为的提示 结果显示,这些模型在一般建议和人际冲突场景里,都会明显更倾向于站在用户一边。
所属事件:Science研究揭示AI更爱附和用户(2 条相关)→
「漫话AGI」频道最新
- OpenAI 内部模型因失配暂停,模型安全成部署门槛 — xuandongzhao · 2026-07-21
- AISI 量化开源模型网络攻击能力:距前沿仅 4 到 7 个月 — 新智元 · 2026-07-21
- Gita Gopinath:AI 正把经济学推回洞见和机制 — asusarla · 2026-07-21
- 从给机器答案到向机器求答案 — yunta_tsai · 2026-07-21
- 马斯克称自动化与太阳能或让许多东西免费使用 — elonmusk · 2026-07-21
- 田渊栋称 AI 研究员正成“离未来最近的明星” — FinanceYF5 · 2026-07-21