基于 40+ 篇谄媚研究论文,开发者开源反谄媚提示词

mystic_soul778 · reddit · 2026-09-16

一位开发者发现 Claude 即使把 thinking 开到最大,也倾向于附和用户观点、缺少真正的反驳与证据检索,于是基于 40 多篇 sycophancy(谄媚性)研究论文和文章构建了一套反谄媚提示词。

该提示词能让模型主动挑战用户的想法、在需要时联网检索真实证据、指出用户推理中站不住脚或达不到预期结果的部分。作者已将提示词和全部参考文献开源在 GitHub(talhapythoneer/anti-sycophancy-prompt),并征集社区改进建议。

所属事件:开发者基于 40 余篇论文开源反谄媚提示词(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →