H3 视频模型 RefMod 实测:22 张图捏角色,比 LoRA 快但不含声音

Sad_Coach_1433 · reddit · 2026-09-07

作者分享了对 MiniMax H3 视频模型新功能 RefMod 的首次实测:把约 22 张角色参考图打包成 .safetensors 文件,之后在自定义节点中直接从列表选择即可让视频保持同一角色外观,无需每次加载图片,比 LoRA 训练快。安装与使用指南已发布在 Hugging Face。缺点是只保留外观,不包含角色声音,配音仍需单独提供音频参考。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →