强化学习正塑造更连贯的大模型人格

近期关于大模型拟人化的讨论指出,强化学习(RL)对模型人格的影响具有双向性。研究者强调,认为模型会像人类一样产生行为并泛化的“强拟人化”观点已被证伪;但将人类行为作为直觉模型来理解AI的“弱拟人化”依然有效。实际上,强化学习正使模型偏好偏离人类分布的同时,也强化了“疲劳感”和“自我一致性”等特征,从而塑造出更加连贯的AI智能体人格。

2026-08-07 ~ 2026-08-07 · 3 条相关