H3 视频生成技巧:用潜在噪声掩码设置自定义音轨
kabachuha · reddit · 2026-08-21
作者分享了一个在 H3(可能指视频生成模型)中设置自定义音轨的技巧,无需使用 R2VA 工具。该方法利用潜在噪声掩码(latent noise masks)来实现音轨的定制化。演示视频展示了具体操作效果。
「多模态」频道最新
- 音乐超分 LLM:是否存在类似视频超分的音频增强模型? — LeatherRub7248 · 2026-08-24
- 描述梦境给AI龙,它即生成星球带你体验 — repligate · 2026-08-24
- 用金缮纹理修复3D模型编辑后的裂缝 — repligate · 2026-08-24
- 用 FL2VA 模型制作汉尼拔角色视频 — Nimblecloud13 · 2026-08-24
- MiniMax H3 助力复活中世纪短视频创作,工作流全公开 — zanatas · 2026-08-24
- NAPE 音频预训练法开源:无解码器 SOTA — kastnerkyle · 2026-08-24