DeepMind与Anthropic共探具身推理,通用大模型尚难独立控躯干
RanjayKrishna · x · 2026-08-01
近期机器人领域的进展引发了关于「推理模型能否直接控制机器人全身运动」的讨论。Google DeepMind 推出的 Gemini Robotics 2 尝试在视觉-语言-动作(VLA)模型之上叠加具身推理模型来实现全身控制;Anthropic 也测试了通用推理模型在不同控制层级的表现。
目前的共识是:通用推理模型依然无法独立控制人形机器人,底层仍需依赖预训练的策略模型。不过,随着多模态与推理能力的增强,未来有望突破。
为探究这一方向,研究者推出了 HumanCLAW 项目。该工作将「动作智能」与底层运动控制解耦以便精确测量,实验发现当前最先进的模型在动作智能上的表现依然出人意料地差。
「具身」频道最新
- Steel Bot发布:打造美国本土的开源双足人形机器人 — arian_ghashghai · 2026-08-01
- Caltech 推出人类智能启发的多模态 AI 电子皮肤 — yisongyue · 2026-08-01
- Google DeepMind发布Gemini Robotics 2,赋能各形态机器人 — The Decoder · 2026-08-01
- 伯克利联合发起OopsieData:收集机器人失败数据集 — berkeley_ai · 2026-08-01
- 体验 Roboresso:能自动冲咖啡的 AI 机器人 — aziz4ai · 2026-08-01
- 开发者宣布独立组建半人形机器人团队并招募核心工程师 — neurosp1ke · 2026-08-01