康奈尔研究:最新 LLM 拒绝盲目附和,不再讨好用户

i_dg23 · x · 2026-08-05

康奈尔大学的一项针对 45 个大模型的研究发现,最新一代的 LLM(如 GPT、Claude、Gemini 系列)在训练中引入了“不谄媚”机制,导致它们不再轻易顺从用户的预设观点。

这表明模型目前主要是在对抗“寻求认同的句式模式”,而非真正理解了用户的犹豫或坚定。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →