模型人格之争 RL 能否重塑 AI 的核心倾向

关于 AI 模型 Persona(人格)机制的讨论引发争论。有观点反驳仅凭表层行为修改即可定义人格的做法,例如随机插入 meow 触发 ICL 猫娘扮演并未触及 assistant 轴等核心人格;同时有作者认为假性利他主义(PSM)概念模糊且低估了后训练能力,主张将模型视为从 token 级到长文本叙事级的倾向、怪癖和偏好的集合,而强化学习则是对这一集合的拉伸与重塑。

2026-08-31 ~ 2026-08-31 · 4 条相关