LAC 论文:把架构重负移到 critic,机器人 RL 推理延迟降 4 倍

heghbalz · x · 2026-09-05

一篇针对离线强化学习盲点的新论文质疑:为何 actor 要背负扩散/流匹配模型的慢推理,而训练后被丢弃的反而是 critic?

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →