新方法SPP:从零开始注入人格,3B模型对齐效果显著提升

dhadfieldmenell · x · 2026-08-15

一篇新论文提出合成人格预训练(SPP)方法,旨在从预训练初始阶段就注入期望的人格,以解决传统预训练中人格混杂且难以控制的问题。研究者在3B参数模型上进行了实验,结果显示在价值观和对齐方面取得了显著提升。

所属事件:新论文提出合成人格预训练显著改善模型价值观(2 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →