研究显示在线 RL 中动作分块同样显著提升 Contrastive RL 表现
ben_eysenbach · x · 2026-09-03
Kamil Dybek 等人的研究指出,action chunking(动作分块)此前主要在离线和离线到在线强化学习场景中被研究,而他们的结果表明其收益并不局限于此:即使在纯在线设定下,Contrastive RL(CRL)也能从动作分块中获得显著提升。
所属事件:研究:动作分块让对比强化学习在线性能提升逾九成(2 条相关)→
「具身」频道最新
- 无方向盘无踏板的 Cybercab 已在奥斯汀街头无人行驶 — TinfoilTricorn · 2026-09-03
- 用 Blender MCP 教机器人小鸭滑滑板,尺寸全由机器人自定 — TinfoilTricorn · 2026-09-03
- 强化学习驱动平衡机器人系列完结,加入遥控指令操控 — ShawnHymel · 2026-09-03
- 人形机器人上台像晕倒山羊一样被拖走,网友笑称「越傻越可爱」 — eyishazyer · 2026-09-03
- Wayve 自动驾驶车队登陆 Uber,伦敦可叫无人驾驶车 — alexgkendall · 2026-09-03
- 开源陪伴机器人 Autonomous Lamp 售价 499 美元,带 70+ 技能商店 — dee_hw · 2026-09-03