Flex-π 模型发布:融合 3D 与语义的机器人世界动作模型
abhishekunique7 · x · 2026-08-13
研究团队提出 Flex-π,一种多流世界动作模型。该模型在训练时联合预测未来的 RGB、3D 点图和 DINO 语义,从而为动作生成继承强大的 3D、以对象为中心和时空先验。
- 架构优势:部署灵活,可从单一检查点作为 VLA、完整 WAM 或介于两者之间的任何形式运行。
- 性能表现:比 WAM 和 VLA 基线更具 demo 效率,且推理速度快于 π0.5。
所属事件:Flex-π 模型发布:融合 3D 与语义的机器人世界动作模型(3 条相关)→
「具身」频道最新
- Runway 宣布 9 月旧金山峰会,齐聚机器人与物理 AI 大佬 — c_valenzuelab · 2026-08-13
- Patch Policy:利用密集视觉特征提升机器人控制效率 — NielsRogge · 2026-08-13
- VLAI 发布双臂轮式人形机器人 K1,售价低于 3000 美元 — chris_j_paxton · 2026-08-13
- 为何机器人不能仅靠视频学习?缺少动作数据 — chris_j_paxton · 2026-08-13
- 开发者打造TouchDesigner全自主冥想系统:脑机接口驱动AI视频 — Chuka444 · 2026-08-13
- NPU 正被植入监控摄像头,端侧 AI 视觉加速普及 — zephyr_z9 · 2026-08-13