斯坦福揭示模型趋同成因,生成多选项提升 2.1 倍多样性

simplifyinAI · x · 2026-08-23

斯坦福研究人员发现,AI 模型倾向于给出相同答案的根源在于人类标注员在 RLHF 过程中偏好更“熟悉”的答案,这种偏见被固化进模型。无需重新训练,只需在 Prompt 中要求模型生成多个答案并标注概率(例如“生成 5 个笑话及对应概率”),即可显著缓解这一问题。实测显示,该方法能使创意写作(诗歌、故事、笑话)的多样性提升 1.6-2.1 倍,且不会降低事实准确性或安全性,能力越强的模型受益越明显。

所属事件:研究称让模型生成多选项可大幅提升回答多样性(3 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →