GenCine 全靠学术算力完成:技术细节与项目页公开
anand_bhattad · x · 2026-10-03
GenCine 线程收尾帖:全部训练与实验均在学术算力上完成(Johns Hopkins DSAI 支持)。项目页披露技术细节:图像经深度估计与动态掩码转为彩色点云,在 Blender 中选择前景区域作为运动手柄并编排路径,逐帧渲染背景 XYZ、前景 XYZ 与身份三张图,经冻结 Wan VAE 编码,通过半分辨率侧分支与残差连接条件化冻结扩散模型,仅训练侧分支、投影与 LoRA 适配器。XYZ 图按首帧包围盒归一化编码世界坐标。
所属事件:JHU 开源 GenCine:单图生成视频并 3D 控制运动(3 条相关)→
「多模态」频道最新
- Seedance 2.5 一镜到底追船大片刷屏,完整 Prompt 公开 — umesh_ai · 2026-10-03
- 自制 ComfyUI 工作流为 Blender 角色自动重贴图,效果持续进化 — o0ANARKY0o · 2026-10-03
- AI 视频编剧水准惊艳,博主称赞 ElevenLabs v4 拉丁语发音 — ctjlewis · 2026-10-03
- 视频即 3D 物体演示升级:可在场景中分割并检索任意物体 — andy_matuschak · 2026-10-03
- LTX 2.5 Restore IC-LoRA 开源:老录像一键修复上色 — TinfoilTricorn · 2026-10-03
- Photoshop 移除工具再升级:可连带消除阴影与倒影 — jnack · 2026-10-03