影眸发布 3D 场景生成模型 WorldGen,一张图生成可交互场景
智东西 · wechat · 2026-09-01
上海 3D 生成公司影眸科技发布世界生成模型 Hyper3D WorldGen,推动 3D 生成从「单个资产」走向「完整场景」。用户上传一张场景图片后,模型自动识别主要物体(约 2-3 秒生成单个 3D 预览,2-3 分钟还原完整场景),生成多个独立、可编辑、可交互的资产。其核心 CAST 架构曾获 SIGGRAPH 2025 最佳论文,可从单张图片补全被遮挡结构并推断物体间接触、支撑等关系;可交互物体用 Mesh、背景用 3D Gaussian Splatting 混合表达,SimReady 功能还能估计质量、摩擦系数等物理属性。
应用上,WorldGen 覆盖具身智能、游戏、影视、XR 等领域:已与地瓜机器人、谋先飞合作推出机器人仿真训练方案,7 月与 Unity 中国宣布合作,影视上可与 Seedance 2.5 等视频模型结合解决多镜头空间一致性问题。团队表示现阶段以刚体生成为主,物理属性靠推断不能作精密工程数据,各行业落地仍处于内测或验证阶段。
所属事件:影眸发布 WorldGen:单图生成可编辑 3D 世界(8 条相关)→
「具身」频道最新
- 机器人播客 RoboPapers 迎来第 100 期,社区多位大佬出镜 — ruilong_li · 2026-09-03
- Unity 研究员把客厅切成数十亿毫米级体素,Stanford 演讲惊艳全场 — Scobleizer · 2026-09-03
- Meta Muse Spark 55 天连跳三版:照片生成 3D 仿真成本仅 0.6 美元 — alexandr_wang · 2026-09-03
- 反事实调试方法将世界模型 sim2real 故障定位扩展到百万步 — sarahcat21 · 2026-09-03
- Mila 等 15 机构提出 ComBodied Agents:AI 目标不是替你干活而是让你更强 — jiqizhixin · 2026-09-03
- 智元研究聚焦:CReF 助人形机器人复杂地形实时落脚 — Scobleizer · 2026-09-03