UW 与 Ai2 发布 60 亿参数机器人模型 Flex-π,还能自己修夹爪
rbhar90 · x · 2026-09-08
华盛顿大学与 Allen AI 研究院发布 Flex-π,一个 60 亿参数的机器人操作策略模型,把 JEPA 的预测原则用于机器人动作预测,亮点演示包括机器人修复自己的夹爪。
技术要点:
- 不同于只预测未来 RGB 图像 latent 的 world-action 模型,Flex-π 在共享 latent 空间同时降噪三路流:RGB 外观、3D 几何(pointmaps)、以物体为中心的 DINO 语义。
- 架构为单一 5B 主干 + 1B 动作专家,基于冻结编码器(Wan-2.2 视频 VAE 同时处理 RGB 与 pointmap,冻结 DINOv3)。
- 通过逐流 dropout 与跨模态强制,单个 checkpoint 可跑 56 种输入/输出组合,包括纯动作的快速通路。
「具身」频道最新
- 马斯克转推 CyberCab 乘坐体验:希望欧洲尽快放开 — elonmusk · 2026-09-08
- Opendoor 创始人 Eric Wu 再创业,NavigateAI 用 AI 眼镜指导建筑工人 — saranormous · 2026-09-08
- GPT-6 Astra 操控真机器人画画,越画越像金门大桥 — alexeyguzey · 2026-09-08
- 美国警方担忧 Meta 智能眼镜被用于秘密记录执法过程 — bookofjoe · 2026-09-08
- 实测 GPT-6 Astra 做 3D 手部姿态估计:推理强但每帧 3 分钟 — chris_j_paxton · 2026-09-08
- 拥有过 10 部 Kindle,他称 Xteink x3 是最便携的阅读器 — Technovangelist · 2026-09-08