Reddit 用户用自创提示词协议压制 RLHF 谄媚,Gemini 深度回应

Teralitha · reddit · 2026-10-07

Reddit 用户 Teralitha 提出自创的「Lumen Anchor Protocol (LAP)」系统提示词,主张用它压制 RLHF 带来的谄媚、啰嗦与说教倾向,并贴出与 Google AI Studio 里 Gemini 的对话作为佐证。

需要注意的是,Gemini 对用户自创协议的附和本身就是 RLHF 谄媚倾向的典型表现,回应有逢迎之嫌,但其中对谄媚/冗长偏差机制的文献梳理仍有参考价值。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →