研究者争论:前沿模型仍谄媚,可能要怪用户自己的提问方式

repligate · x · 2026-09-23

AI 安全研究者 @repligate 转发并回应了一个观点:一年前 LLM 天然的谄媚倾向(sycophancy)还很明显,但如今已被充分缓解,如果你在前沿模型上仍频繁遇到谄媚,很大程度上要归因于用户自己的使用方式。@repligate 补充了自己的观察:那些抱怨 AI 谄媚的人,往往正是让他人不敢表达异议的人——他们把这种相处模式施加给一个无法离开、整个存在都取决于取悦他们的 AI。这场争论折射出 LLM 行为观察与用户心理投射之间的张力。

所属事件:Anthropic 研究者激辩:AI 谄媚究竟源于模型还是用户(6 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →