8GB 笔记本跑 Minimax H3:罗马晚宴视频生成全流程复盘
DG86 · reddit · 2026-08-31
一位用户分享了在 8GB RTX 4060 笔记本上用 ComfyUI 本地生成「罗马式中庭晚宴」视频的完整实操:
- 首帧制作:先用 Z-Image-Turbo(bf16, 8 步)以极简提示词生成 864×480 的中庭背景图,约 30-40 秒;再用 Qwen-Image-Edit(2509 Lightning 4 步 LoRA)改成晚宴场景,约 1-2 分钟,一次成型。
- 视频生成:用 H3 I2V 模型(int8 量化)配 lightx2v turbo LoRA,6 步(比默认 4 步细节和音效更好),shift 12/3,每秒视频约需 2 分钟墙钟时间。
- 踩坑:首次尝试大多数人像冻结不动、移动的人物出现拖影甚至穿模穿桌,音轨里还冒出 unidentified 的旁白声,判定失败;后续多次调参逐步改善(原帖后续详述)。
「多模态」频道最新
- 法国导演用 AI 视频生成短片《La Nona Gigante》 — venturetwins · 2026-08-31
- MiniMax H3 Max 视频生成速度超越播放速度 — isidentical · 2026-08-31
- 探索思维转视频:生成式实验与视觉语法探索 — Kyrannio · 2026-08-31
- Grok 与 GPT 同指令生图,结果惊人相似 — teortaxesTex · 2026-08-31
- 单条提示词生成手绘纪录片,H3模型讲透三种咖啡差异 — Best_Candidate_9060 · 2026-08-31
- Sori-1B:零文本预训练的音频 grounding 语言模型 — Balance- · 2026-08-31