深入 H3 Latents 与 VAE 解码,开源 MiniMax 静态图新模式工作流
shootthesound · reddit · 2026-09-26
作者花数天深挖 MiniMax H3 的 Latent 结构与 VAE 解码过程,为 ComfyUI 做出一个新的 Stills(静态图)模式,并开源在 GitHub(ComfyUI-Fizgig-H3-Still)。
- 效果上作者认为相较默认解码是明显提升,虽不完美
- 速度快,工作流中仅低强度使用 turbo LoRA,也可关闭并提高步数
- 效果对 turbo LoRA 的选择及 sampler/scheduler 组合敏感,作者 hunting 出一组较优搭配,但不排除更好组合
「多模态」频道最新
- 一人一周用 Flora AI 做完 Rhizome 30 周年全套视觉 — round · 2026-09-26
- Claude 动画生成实测:70 分钟烧掉 20 美元免费额度 — FishermanFit618 · 2026-09-26
- Claude Opus 5.5 写巴赫风格赋格,LLM 音乐已达可欣赏水平 — floguo · 2026-09-26
- 用 HTML/CSS 加 Kokoro 语音合成,22 秒竖屏短片全流程自动化 — viveky259 · 2026-09-26
- 作者用 Claude 把长文一键做成音乐视频 demo — floguo · 2026-09-26
- MiniMax H3-VDN 约 9 秒生成 15 秒 720P 视频 — bingxu_ · 2026-09-26