Minimax H3 实测:一张图加音频生成唱跳视频,6 步 768p 半小时
aziib · reddit · 2026-09-08
作者分享用 Minimax H3 从参考图和音频生成唱歌跳舞视频的完整工作流:使用 HuggingFace 上的 better-human-motion LoRA、Civitai 上的 fast-minimax-h3 工作流、fused-turbo-int8 量化 checkpoint;角色形象来自 VRoid 3D 模型,歌声用 RVC 从 ElevenLabs 声音训练而成。生成参数为 6 步、768p,15 秒视频约需 30 分钟。
所属事件:MiniMax H3 实测:一张图加音频生成唱跳视频(2 条相关)→
「多模态」频道最新
- 用 Grok + Intangible 制作 SpaceX 致敬动画 — bilawalsidhu · 2026-09-09
- 一张 32GB 消费级显卡微调 Qwen-Image-Edit 变深度估计器,几天搞定 — AntonObukhov1 · 2026-09-09
- Marigold V2 发布:单 GPU 后训练图像生成器做深度估计,入选 SIGGRAPH Asia 2026 — AntonObukhov1 · 2026-09-09
- AI 视频:骑龙穿越中世纪小镇的沉浸式 POV — Brave-Wishbone-3650 · 2026-09-08
- theDAW:100% 本地运行的 AI DJ 应用获 Stability 团队背书 — cocktailpeanut · 2026-09-08
- GANTASMO 发布全本地 AI DJ 应用 theDAW,集成 Suno 与 Lyria — cocktailpeanut · 2026-09-08