ComfyUI-MiniMaxH3-CLSS 大更新:分场景参考、音频重组与流式潜在放大
nazgut · reddit · 2026-09-12
作者发布 ComfyUI-MiniMaxH3-CLSS 更新,一次生成 ref2vid 长视频并配 MiniMax 音乐模型配乐。主要变更:
- 分场景参考节点:CLSSH3SceneReference(s) 可将参考图/音频绑定到多场景生成中的单个场景,tokenize 时绑定 <Picture N>/<Audio N> 标签,最多 9 图 + 3 音频;附带 3 场景工作流
- 全场景参考单节点:CLSSH3SceneReferencesAll 让每张参考图作用于所有场景,音轨自动按场景切窗(默认 10 秒/场景),改场景列表无需重新接线
- globaltext:共享风格/音景/质量规则写一次,自动复制到每个场景块顶部
- 音频重组(turbo-LoRA 修复):可选按块从纯噪声生成全新音频 take;实测对 turbo 音频重新加噪只会复现同一 take(cos 0.90–0.96),换新噪声才真正改变
- 块间神经潜在放大:采样器内每个 chunk 在 SLB 步后立刻放大,全窗口提供时序上下文并交叉淡化接缝,长视频从不高分辨率整体存在(约 0.7 GB fp16)
- 修复 recompose 崩溃、跨块噪声场 bit-identical 因果性、音频遥测记账等问题
「多模态」频道最新
- 有人专门教图像生成模型认识十六进制色号,ECCV 2026 论文揭示盲区 — ducha_aiki · 2026-09-12
- 多角度生成同一 3D 结构太难?作者用多角度参考矩阵解决 — LCD-9 · 2026-09-12
- Blender MCP 加 Astra 跑动画,效果令人惊艳 — Dimillian · 2026-09-12
- 分步提示法修图:Nano Banana 三轮工作流显著提升 AI 上色质量 — aziz4ai · 2026-09-12
- Pwnisher 大奖得主实测 GPT Astra×Blender×Dreamina 全流程 3D 动画管线 — aziz4ai · 2026-09-12
- 用 GPT-6 Astra 半自动复刻名古屋站,一句「生成周围」搞定全城 — gabrielchua · 2026-09-12