突破「摸不准」瓶颈:具身智能引入触觉感知的技术路径解析

机器之心 · wechat · 2026-08-02

当前主流的视觉-语言-动作(VLA)模型在非结构化环境中表现良好,但在需要精细物理交互的场景下,因缺乏触觉感知而面临精度受限的瓶颈。

文章指出,仅靠视觉的世界模型无法捕捉接触力学、材质等隐性物理属性。近期研究正从算法层面将触觉感知融入大模型框架,形成了多种技术路径:

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →