机器人训练新法:taga-style 注意力机制实现大规模并行
ChongZzZhang · x · 2026-08-17
ChongZzZhang 分享了一种机器人训练方法:采用 taga-style 的注意力机制,将任意映射到 12x10 的网格,并使用 topk=64 的稀疏注意力。在 4xGH200 硬件上,每个 GPU 可并行运行 16000 个环境,每个环境步数为 24,最终策略可直接部署。
「具身」频道最新
- AI 愿景:让机器人接手湿实验 — dr_alphalyrae · 2026-08-17
- 特斯拉FSD v14.3.6曝光:百亿MoE模型与RL强化 — qinzytech · 2026-08-17
- HopTo 机器人:用「跳跃+被动弹簧」替代持续飞行节能 75% — MarwaEldiwiny · 2026-08-17
- 美 FCC 封杀外国地面机器人:非禁售,限准入且不点名中国 — the-uncanny-squad · 2026-08-17
- AME2 神经映射适配 Livox 激光雷达,一日内完成训练 — ChongZzZhang · 2026-08-17
- 周末举办微型机器人学习黑客松,探索具身智能 — DominiqueCAPaul · 2026-08-17