用 MiniMax H3 做口型同步:完整 ComfyUI 工作流开源
uhf789 · reddit · 2026-09-05
作者演示用 MiniMax H3(ComfyUI 内)结合 Topaz Video AI 的 Proteus 模型和 CapCut,对 Nilüfer《Geceler》专辑封面做口型同步视频,并公开了完整工作流文件。用法简单:输入参考图和目标音频,渲染时长对齐音频长度;为获得最佳口型一致性,需把音频的准确文字转写填入提示词字段。工作流由作者借助 Claude 开发。
「多模态」频道最新
- DiSReg 新 LoRA 训练法:用自正则化消除触发词外的标签污染 — bdsqlsz · 2026-09-06
- MiniMax 推 H3 Max Director:实时可控视频流,每秒最低 0.02 美元 — isidentical · 2026-09-06
- 用 3D 建模替代逐像素扩散,astra 宣称开启视频生成新范式 — IndraVahan · 2026-09-06
- 4 秒生成 10 秒视频:Yoroll 开源 H3 后上线永不停播的 AI 直播 YoLive — vista8 · 2026-09-06
- Google 将 Lyria 3.5 音乐生成模型直接嵌入 Gemini 应用 — The Decoder · 2026-09-06
- Qwen 3.8 27B 本地驱动 Blender:MCP 让模型徒手搭 3D 羊驼 — jacek2023 · 2026-09-06