kalomaze:能力迁移弱因行业只做「分域赌运气」,不预测迁移

kalomaze · x · 2026-09-12

kalomaze 在与 StefanGliga 的讨论中 argument:当前 RL 训练能力迁移之所以弱,是因为行业并未真正尝试通过更好的「迁移预测」来显式瞄准它;现有做法压倒性地是「按显式领域分层然后祈祷」。人类对什么能带来广泛迁移的直觉很差,于是只堆人们已经知道要的合成数据——通常是 SWE 工程师关心的那些。

所属事件:kalomaze:信息不对称而非可验证性决定 RLVR 泛化(9 条相关)→

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →