RL训练分布越广,模型插值能力越强?

yacineMTB · x · 2026-08-14

yacineMTB在回复中表示,如果RL训练分布足够广泛,模型将能够在该分布内进行插值。他比喻说,就像把口香糖面团拉伸到多个方向,试图做成球。

所属事件:yacine称AI能力靠逐块构建,智能未必通用(3 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →