RL 强化学习使大模型人格既偏离又趋近人类特征

voooooogel · x · 2026-08-07

针对“模型拟人化”视角的讨论,voooooogel 提出,强化学习(RL)对模型人格的影响是双向的:它既可能将模型偏好推向人类分布之外,也能强化诸如“疲劳感”和“自我一致性”等类人行为。拟人化始终只是一个有用的分析透镜,而非绝对本质。

所属事件:强化学习正塑造更连贯的大模型人格(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →