Musubi Tuner 合入 MiniMax H3 视频音频模型训练支持
bdsqlsz · x · 2026-09-16
kohya 宣布 Musubi Tuner 已在 main 分支合并对 MiniMax-H3(文生视频+音频模型)的训练支持,基础功能由 sdbds 贡献。
- 官方文档 minimaxh3.md 提供完整用户指南:下载文件、按目标选择训练配方,以及缓存、训练、采样与生成的命令
- 配套两篇文档:minimaxh31f.md 讲单帧(图像)生成与训练,包括时间索引、编辑/中挂数据集、参考图条件生成;minimaxh3advanced.md 深入 timestep/loss 内部、guidance loss 与 teacher matching、缓存与量化、生成细节
- 作者提到 subject-reference teacher 学习的数据集构建方法较难理解,后续会另行整理说明
「多模态」频道最新
- 用 Grok+Suno 打造 6 分钟 AI 二重唱全流程复盘 — Kyrannio · 2026-09-16
- 3D 建模店主实测:几张照片让 AI 生成好友人偶 — Popular_Double4000 · 2026-09-16
- 10 天花费 29575 美元:PJ Ace 用 AI 制作出 Nexus 第 4 集 — NightsRadiant · 2026-09-16
- Unfold 获 OpenAI 新加坡黑客athon两项大奖:把 2D 说明书变 3D 动画指南 — cedric_chee · 2026-09-16
- GPT-6 Astra 单参考图重建室内 3D 场景,结构意外稳 — Dazzling_Gate_330 · 2026-09-16
- 用 flovaai 复刻爆火「火山爆米花」梗,AI 随想成片 — SimplyAnnisa · 2026-09-16