机器人训练新法:taga-style 注意力机制实现大规模并行

ChongZzZhang · x · 2026-08-17

ChongZzZhang 分享了一种机器人训练方法:采用 taga-style 的注意力机制,将任意映射到 12x10 的网格,并使用 topk=64 的稀疏注意力。在 4xGH200 硬件上,每个 GPU 可并行运行 16000 个环境,每个环境步数为 24,最终策略可直接部署。

原文链接 →

「具身」频道最新

更多「具身」频道 AI 资讯 →