RL 与 SFT 泛化机制迥异:好行为难泛化成全局人格
1a3orn · x · 2026-09-09
1a3orn 在一条思辨线程中指出:如果 LLM 在训练中只「看到」自己做好事,按 Persona Selection Model 的直觉它理应泛化为「做好事的人」,但事实并非如此——RL 的泛化方式与 SFT 截然不同。
所属事件:思辨:RL 环境中的模型或学到「能用就用」启发式(3 条相关)→
「漫话AGI」频道最新
- 开源若不追赶,AI 发现能力将落入双寡头之手 — ayushthakur0 · 2026-09-09
- 观点:一旦被拿去训练,你的洞见就不再是你的洞见 — cjmaddison · 2026-09-09
- 中美AI安全议题将上峰会桌面,学者呼吁建立沟通渠道 — austinc3301 · 2026-09-09
- Anshul Kundaje:基因组学正处于技术突破的黄金期 — anshulkundaje · 2026-09-09
- 斯坦福 Kundaje:ML for Bio 领域该改革同行评议评价体系了 — anshulkundaje · 2026-09-09
- Kundaje:可复现软件与透明技术报告都该算重量级科研贡献 — anshulkundaje · 2026-09-09