MacPaw 发布 GenRA:多模态 LLM 驱动 3D 模型骨骼动画
ducha_aiki · x · 2026-09-08
MacPaw Research 在 ECCV OpenSUN3D workshop 上展示论文 GenRA,一个端到端框架,用多模态 LLM 为用户提供的 rigged 3D 资产生成和编辑骨骼动画。
- 模型以 rig 层级、bind pose、多视角渲染、自然语言指令以及用关键帧抽稀紧凑表示的运动示范为条件,预测稀疏关节变换关键帧,再转成平滑动画曲线写回原资产,不改动几何、蒙皮和 rig 层级
- 无需任务特定训练或重定向,支持零样本/少样本生成,以及局部化、组合式、时间与定量化的迭代修改
- 在 40 个资产、1080 次盲评中,GenRA 对 Puppeteer 拿到 74.5% 的平局感知偏好率,中位生成时间缩短 83%,成本降低 84%
「多模态」频道最新
- 8GB 显卡本地跑 Flux 与 Wan 2.2:三个设置错误拖慢了渲染 — leonbuilds · 2026-09-08
- SuperSplat Editor 3.0 发布:基于 WebGPU 重写,支持千万级 Gaussian — willeastcott · 2026-09-08
- AI 做 PPT 不再文字崩坏:先定稿再抽字后回填的实操流程 — algo_diver · 2026-09-08
- VISART 2026 工作坊征稿:商业与本地模型横评艺术目录解析 — ducha_aiki · 2026-09-08
- 网友用一句提示词生成「史上最可爱救援行动」图像 — umesh_ai · 2026-09-08
- Comfy Cloud 伙伴节点上线:视频生成低至每秒 0.3 点数 — aastle · 2026-09-08