R3:通过强化学习训练机器人进行自然语言推理
tw_killian · x · 2026-09-02
新工作 R3 提出通过强化学习让机器人在行动前进行自然语言推理。研究指出,机器人的测试时计算扩展不仅仅是使用更强的 LLM/VLM,而是在感知-行动循环中利用推理改变后续观察。
「具身」频道最新
- ESP32 多传感器环境监测站开源方案 — JeremyCMorgan · 2026-09-02
- SnakeROS:纯 Python 的 MicroPython ROS 2 客户端 — kscottz · 2026-09-02
- Arcturus 推出 Steam VR 高清透视模块 — kscottz · 2026-09-02
- 机器人何时引发大规模失业?分析机械化与自动化的差异 — soumitrashukla9 · 2026-09-02
- 脑机接口穿戴设备 Atlas 1.0 开启预售 — janjongboom · 2026-09-02
- 人形机器人论文周报:坐立控制与 LAC 研究 — carlosdponx · 2026-09-02