研究显示在线 RL 中动作分块同样显著提升 Contrastive RL 表现

ben_eysenbach · x · 2026-09-03

Kamil Dybek 等人的研究指出,action chunking(动作分块)此前主要在离线和离线到在线强化学习场景中被研究,而他们的结果表明其收益并不局限于此:即使在纯在线设定下,Contrastive RL(CRL)也能从动作分块中获得显著提升。

所属事件:研究:动作分块让对比强化学习在线性能提升逾九成(2 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →