Perceptron Inc 发布SotA具身VLA模型,将感知与控制统一训练
code_star · x · 2026-08-20
Perceptron Inc 团队宣布训练出了业界领先的 VLA(Vision-Language-Action)模型,并计划开源。
核心观点:
- 感知与控制统一:作者认为感知和控制领域的分离是历史发展的产物,而非物理智能的运作方式。下一代模型将是一个真正的具身基础模型,将 VLM(视觉语言模型)、ER(具身表征)和 VLA 作为一个统一问题进行联合训练。
- 迁移学习发现:为了构建前沿 VLM 所进行的数据和模型工作,意外地对 VLA 的训练产生了显著的迁移学习效果。
- 开源计划:团队正在冲刺该模型及论文的开源发布。
所属事件:Perceptron发布SotA具身VLA模型并计划开源(2 条相关)→
「具身」频道最新
- 助听器厂商 Starkey 宣称布局 AI 近十年 — BrandonSawalich · 2026-08-20
- Blueprint 融 140 万加元,要做硬件版 Lovable — Scobleizer · 2026-08-20
- 2890万参数LLM成功在ESP32-S3微控制器上运行 — tom_doerr · 2026-08-20
- 机器人学核心难题:如何在真实世界实现单样本泛化 — Scobleizer · 2026-08-20
- 七个月参数暴涨千倍:谷歌 RT-1 仅 5500 万,RT-2 达 550 亿 — binarybits · 2026-08-20
- 把10欧元玩具改造成LLM机器人,作者公开完整改造流程 — calabi_and_yau · 2026-08-20