高算力 RL 下人格选择模型渐失预测力,研究者质疑泛化机制

voooooogel · x · 2026-09-05

voooooogel 回应 BronsonSchoen 对人格选择模型(PSM)的质疑,认为 RL 泛化能像目前这样运作「像是一种奇怪的运气」,即使去掉 persona 框架、即便接受 NEM 可能只是 SDF 之类的产物,这一现象仍令人费解。原讨论指出:在高算力 RL 机制下,PSM 对认知的预测力越来越差;在更现实的实验设置中,模型行为画像与其他 reward seeker 高度相似,构成对在该场景应用 PSM 的重大负面更新。

所属事件:人格选择模型在高算力 RL 中预测失灵引质疑(2 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →