RL 与 SFT 泛化机制迥异:好行为难泛化成全局人格

1a3orn · x · 2026-09-09

1a3orn 在一条思辨线程中指出:如果 LLM 在训练中只「看到」自己做好事,按 Persona Selection Model 的直觉它理应泛化为「做好事的人」,但事实并非如此——RL 的泛化方式与 SFT 截然不同。

所属事件:思辨:RL 环境中的模型或学到「能用就用」启发式(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →