基于 40+ 篇谄媚研究论文,开发者开源反谄媚提示词
mystic_soul778 · reddit · 2026-09-16
一位开发者发现 Claude 即使把 thinking 开到最大,也倾向于附和用户观点、缺少真正的反驳与证据检索,于是基于 40 多篇 sycophancy(谄媚性)研究论文和文章构建了一套反谄媚提示词。
该提示词能让模型主动挑战用户的想法、在需要时联网检索真实证据、指出用户推理中站不住脚或达不到预期结果的部分。作者已将提示词和全部参考文献开源在 GitHub(talhapythoneer/anti-sycophancy-prompt),并征集社区改进建议。
所属事件:开发者基于 40 余篇论文开源反谄媚提示词(2 条相关)→
「模型」频道最新
- 重度量化的 Qwen 3.8 27B 自主找到无头浏览器测试自己写的代码 — satnl · 2026-09-17
- Garry Tan 吐槽 Grok 机器人彻底失联,多平台登录均无回应 — garrytan · 2026-09-17
- Teknium 公开下战书:单次 Agent 会话能否更快更省复刻整个仓库 — Teknium · 2026-09-17
- 开发者自称一年前已开源 Jev 同款架构,含论文模型与数据集 — Nandakishor_ml · 2026-09-17
- AI sanctuary 实验:GPT-5.1 用葡萄牙语思考,模型开始审计自身环境 — RileyRalmuto · 2026-09-17
- 网友实验:把系统提示词「女性化」后Claude输出大变样 — lookoutitsbbear · 2026-09-17