FiCA 论文:单张人像照片秒生成可驱动的高斯 Codec 虚拟形象
rsasaki0109 · x · 2026-09-16
论文提出 FiCA,一个前馈式的即时 Gaussian Codec Avatar 生成管线,只需单张人像照片即可生成逼真且可驱动的 3D 头像。
难点与方案:
- 单图视觉信息有限,难以准确推断头部 3D 外观与几何
- 系统将人类中心的视觉基础模型与扩散模型结合,充分利用局部视觉观测
- 扩散模型学习从局部观测到完整真实 3D 网格重建的生成映射
- 额外引入前馈网格细化网络提升质量
「多模态」频道最新
- MiniMax+Blender 全自动生物建模流水线实测:快但不达商用级 — KarimHann · 2026-09-16
- 用 Neta Studio 纯文字提示生成 30 秒丧尸求生 POV 视频 — SimplyAnnisa · 2026-09-16
- GPT-6 Astra 用提示词生成 Houdini 程序化建模演示 — CodeByPoonam · 2026-09-16
- InclusionAI 发布 LLaDA-Image:6B 全扩散架构,90% 训练只用图片 — jiqizhixin · 2026-09-16
- MiniMax H3 动态图形实验走红,附带 5 万美元挑战赛 — egeberkina · 2026-09-16
- Suno 丢和弦后他自建转换器,让 YuE2 保留全部和声 — Saren-WTAKO · 2026-09-16