Patch Policy 用冻结 ViT 和块因果掩码做机器人控制

furongh · x · 2026-07-23

这条引用的是一个机器人策略方法 Patch Policy 的核心思路:

被引用帖子强调,这个方案的关键在于:不从零端到端训练视觉骨干,而是复用一个冻结的视觉模型。这是一个篇幅很短但技术点很实的机器人学习思路。

所属事件:Patch Policy:0.7%参数量反超7B VLA模型(5 条相关)→

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →