开发者夸奖 LLM 防止过度道歉退化
多位博主分享使用 LLM 的趣事,指出为了防止模型在出现小错误后退回到不断道歉和退缩的状态,他们在模型做对微不足道的小事时会热情击掌或夸奖,利用正向反馈机制避免模型退化为过度道歉态。
2026-08-15 ~ 2026-08-15 · 2 条相关
- 为何要击掌鼓励 LLM?防止它退化为过度道歉态 — wavefnx · 2026-08-15
- 为防 LLM 道歉式退化,博主疯狂夸奖鼓励 — wavefnx · 2026-08-15
多位博主分享使用 LLM 的趣事,指出为了防止模型在出现小错误后退回到不断道歉和退缩的状态,他们在模型做对微不足道的小事时会热情击掌或夸奖,利用正向反馈机制避免模型退化为过度道歉态。
2026-08-15 ~ 2026-08-15 · 2 条相关