团队用世界模型基线生成 49 帧 3D 店内漫游,称迈向空间智能
richdotca · x · 2026-10-11
MaxSebti 分享团队里程碑:仅输入一张 AI 生成的商店图片和一条相机路径,其世界模型基线即生成 512×512 的 49 帧漫游视频,并估算出可见 3D 表面,实现了从计算机视觉向空间智能的第一步。作者坦承画面瑕疵明显、未见视角属于预测、可靠的物理仿真仍在前方。转发者补充:WM 学习物理世界运行规律并预测后续,WAM 进一步决定行动,NVIDIA 视世界模型为机器人与物理 AI 的核心基础设施,认为该市场比 LLM 大一个数量级。
「具身」频道最新
- wesbos 开源教程:root 锁死的安卓相框,还让 agent 帮忙 dump 固件 — natesiggard · 2026-10-11
- 比亚迪人形机器人外观专利曝光,双足设计面向服务教育工业场景 — emmanuelvivier · 2026-10-11
- 两年机器人项目复盘:哪些做法有效、教训与值得继续的方向 — k7agar · 2026-10-11
- Scoble 体验 Waymo 新车后仍称 Cybercab 体验更好、运营成本更低 — Scobleizer · 2026-10-11
- 深度长文:世界动作模型 vs VLA,机器人正迎来 GPT-2 时刻 — moschles · 2026-10-11
- Sunflower Robotics 压力再分配技术落地糖尿病足临床治疗 — MarwaEldiwiny · 2026-10-11