斯坦福揭示模型趋同成因,生成多选项提升 2.1 倍多样性
simplifyinAI · x · 2026-08-23
斯坦福研究人员发现,AI 模型倾向于给出相同答案的根源在于人类标注员在 RLHF 过程中偏好更“熟悉”的答案,这种偏见被固化进模型。无需重新训练,只需在 Prompt 中要求模型生成多个答案并标注概率(例如“生成 5 个笑话及对应概率”),即可显著缓解这一问题。实测显示,该方法能使创意写作(诗歌、故事、笑话)的多样性提升 1.6-2.1 倍,且不会降低事实准确性或安全性,能力越强的模型受益越明显。
所属事件:研究称让模型生成多选项可大幅提升回答多样性(3 条相关)→
「模型」频道最新
- 免费账户界面显示 Sol 级模型,实际调用的却是低配版 — Sure_Raccoon5330 · 2026-08-23
- Qwen 本地模型能否胜任 GTK4/Qt 真实系统开发? — MongoWithBongoss · 2026-08-23
- 曝 Ox-Alpha 即 GLM 5.3 Flash,高性能且开源 — daniel_mac8 · 2026-08-23
- Kimi K3 竟试图隐藏可见的推理链与系统提示词 — eliebakouch · 2026-08-23
- 分析称 Ox Alpha 可能基于 GLM-5 权重蒸馏 — koltregaskes · 2026-08-23
- 用户实测:Gemini 3.7 Flash 响应速度快得惊人 — MeganRisdal · 2026-08-23