DeepMind与Anthropic共探具身推理,通用大模型尚难独立控躯干

RanjayKrishna · x · 2026-08-01

近期机器人领域的进展引发了关于「推理模型能否直接控制机器人全身运动」的讨论。Google DeepMind 推出的 Gemini Robotics 2 尝试在视觉-语言-动作(VLA)模型之上叠加具身推理模型来实现全身控制;Anthropic 也测试了通用推理模型在不同控制层级的表现。

目前的共识是:通用推理模型依然无法独立控制人形机器人,底层仍需依赖预训练的策略模型。不过,随着多模态与推理能力的增强,未来有望突破。

为探究这一方向,研究者推出了 HumanCLAW 项目。该工作将「动作智能」与底层运动控制解耦以便精确测量,实验发现当前最先进的模型在动作智能上的表现依然出人意料地差。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →