R3:通过强化学习训练机器人进行自然语言推理

tw_killian · x · 2026-09-02

新工作 R3 提出通过强化学习让机器人在行动前进行自然语言推理。研究指出,机器人的测试时计算扩展不仅仅是使用更强的 LLM/VLM,而是在感知-行动循环中利用推理改变后续观察。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →