网友设想:用视频生成模型做高层策略,复刻 Generalist 双系统架构
12exyz · x · 2026-08-21
用户 @12exyz 在 Generalist AI 演示 GEN-1.5 的帖子下提出技术设想:构建类似 Physical Intelligence pi·0.7 的双系统架构,用语言条件化的高层策略生成子目标,但以视频生成模型替代 BAGEL。原帖演示了 GEN-1.5 可将两个不同任务的物理提示组合成一条连续技能,自动补出重新抓取、纠错等中间动作。由于 Generalist 称其上下文学习能组合视频提示、且对仿真视频乃至人类视频都具鲁棒性,作者推测 AI 生成视频也可用作提示,从而解锁语言导向与更长时程任务。
「具身」频道最新
- 开源 WBC-Mjlab 登陆 mjswan 云端,浏览器试玩 Unitree G1 全身控制 — kevin_zakka · 2026-08-21
- 2026 人形机器人 VC 融资已达 87 亿美元,接近 2025 纪录两倍 — rohanpaul_ai · 2026-08-21
- 人形机器人手指操作难题:袋子在手中仅一秒就掉落 — rohanpaul_ai · 2026-08-21
- 火星是机器人学习无法在地球完成的实验场 — Dr_Singularity · 2026-08-21
- WRC'26 展会:Galbot 展示新型敏捷双足人形机器人 — Distinct-Question-16 · 2026-08-21
- Sherpa 清洗喷涂无人机:单笔作业赚 10 万美元 — debreuil · 2026-08-21