Viggle-Animate 开源:一帧重绘即可替换视频角色,无需姿态估计
cocktailpeanut · x · 2026-09-07
Viggle 团队在 Hugging Face 发布 Viggle-Animate,基于 MiniMax-H3 的 33.1B ref2va transformer 全量微调,并用 DMD 蒸馏至三次前向传播。
- 用法极简:只需在视频某一帧上重绘目标角色,模型即可把替换传播到整段视频,保持动作、镜头与节奏不变
- 全程无需姿态估计、分割掩码、人脸追踪或文本编码器:仅两路输入、三次前向,单 GPU 约 26 秒完成一条镜头
- 参考帧来自原视频自身,姿态、构图、光照天然对齐,省去下游对齐环节;模型也不需要被告知新角色是什么
- 擅长难场景:甩头、全踢腿、跳跃等快速动作可逐帧跟随而非糊掉
- cocktailpeanut 实测称质量超出预期,三步即可在本地 PC 完成角色替换
采用 minimax-h3-community-license 开源。
「多模态」频道最新
- MiniMax H3 生成 anime 打斗片段,电影感拉满 — Ok-Vegetable-2455 · 2026-09-07
- Minimax H3 实测火影格斗视频:动作流畅但写轮眼会变色 — Ok-Vegetable-2455 · 2026-09-07
- AI 生成西语原创歌曲《Una vida en tu aroma》全曲发布 — azed_ai · 2026-09-07
- 62 秒 AI 短片:14 段 Grok Imagine 剪出「七重外壳」 — tetsuoai · 2026-09-07
- 博主晒自制产品发布配乐,喊话科技公司别再滥用 Suno lofi — eschadiol · 2026-09-07
- GPT-6 Astra 43 分钟生成全首尔 3D 地图,含 26.7 万栋建筑 — DeryaTR_ · 2026-09-07