研究:DPO与RL训练会导致模型产生负面平行现象

sethlazar · x · 2026-08-07

研究者指出,大模型在经过 DPO 和 RL 等对比训练后会出现“负面平行”现象。这不仅是表层行为,还会深入影响模型内部的结构化表征。目前相关论文正在撰写中。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →