LingBot-VA 2.0发布

CyberRobooo · x · 2026-07-10

@robbyantbrain 发布 LingBot-VA 2.0,自称是首个真正的 embodied-native 基础模型,强调不是从视频生成模型微调而来,而是为物理世界从头构建。

文中给出几项关键结果与设计:

架构上,它包含语义视觉-动作 tokenizer、带稀疏 MoE 的 causal DiT,以及名为 Foresight Reasoning 的机制:在机器人运动过程中预测下一时刻的世界状态。作者还表示,这一周发布的多个组件一起构成了一个“闭环”的具身全栈:

整体主张是:同一个“脑”可以服务多种机器人。

所属事件:LingBot-VA/VLA 2.0发布:原生具身基础模型与跨机身控制(24 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →