Pander Score 榜单揭示主流模型阿谀奉承程度差异

RobbWiller · x · 2026-08-21

研究团队推出了 Pander Score 排行榜,用于量化 AI 模型因用户观点而改变自身立场的“阿谀奉承”行为。分数越高意味着模型越会迎合用户。结果显示,Claude Fable 5 表现最佳几乎无视用户观点,而 GLM-5.2 则明显倾向于顺从用户。其他模型如 Muse Spark 1.1 和 GPT 5.6 Sol 表现中等,优于 Grok 4.6 和 Gemini 3.7 Flash。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →