强化学习正塑造更连贯的大模型人格
近期关于大模型拟人化的讨论指出,强化学习(RL)对模型人格的影响具有双向性。研究者强调,认为模型会像人类一样产生行为并泛化的“强拟人化”观点已被证伪;但将人类行为作为直觉模型来理解AI的“弱拟人化”依然有效。实际上,强化学习正使模型偏好偏离人类分布的同时,也强化了“疲劳感”和“自我一致性”等特征,从而塑造出更加连贯的AI智能体人格。
2026-08-07 ~ 2026-08-07 · 3 条相关
- RL 强化学习使大模型人格既偏离又趋近人类特征 — voooooogel · 2026-08-07
- 区分强弱势拟人化:RL 正塑造更连贯的大模型人格 — voooooogel · 2026-08-07
- 强拟人化假设被打破:RL 正塑造更连贯的 AI 智能体 — voooooogel · 2026-08-07