Minimax H3 视频声音克隆不稳定,用户晒出完整 ComfyUI 工作流求解
Elzair · reddit · 2026-10-11
用户尝试用 H3 Minimax 的音频参考功能让角色在多个片段中保持同一声音,但效果时好时坏。作者贴出了完整流程:先取参考音频,再用于生成片段,并与外部语音(VoxCPM2)生成的版本对比,还给出了 ComfyUI 节点的完整 prompt 写法(subjectdefinitions、retentionanalysis 等)。作者怀疑是 seed 问题或用法有误,询问社区如何在片段间保持声音一致、是否需要外部生成语音再接入。
「多模态」频道最新
- 开源动漫 DiT 模型仅剩 Anima?社区期待 Krea2 全量微调 — Pristine_Stress_670 · 2026-10-11
- PartLLM 登陆 SIGGRAPH Asia:LLM 驱动任意粒度 3D 网格部件分割 — Promptmethus · 2026-10-11
- Seedance 生成炫酷翅膀特效视频,视觉表现力拉满 — TinfoilTricorn · 2026-10-11
- 融资超千万美元,AI 工作室把《成吉思汗》小说改成六集剧集 — lmoroney · 2026-10-11
- 用户用 Claude 为自己的音乐生成电影感 MV,成片效果获好评 — Pleasant_Salt6810 · 2026-10-11
- 「Bad AI Consciousness Takes Bingo」:用 Suno 唱出来的 AI 圈吐槽 — dioscuri · 2026-10-11