新论文:在预训练阶段注入合成道德反思,3B模型价值观显著改变

sethlazar · x · 2026-08-14

Synthetic Persona Pretraining 论文正式发布,提出在预训练文档中注入10%的合成道德反思,训练至3B参数模型。实验表明,早期干预能显著改变模型的价值优先级。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →