研究模型的推理创造力与组合泛化

tw_killian · x · 2026-07-10

这项 ICML 2026 研究考察模型能否通过重组已掌握的技能,解决新的推理问题,也就是所谓的“推理创造力”。研究从机制层面分析了 SFT 和 RL 如何帮助模型提炼可复用结构。

所属事件:探秘后训练:SFT与RL如何提升模型推理组合泛化(5 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →