MiniMax H3 实时交互视频实测:角色一致性 LoRA 训练难题

Big-Set9728 · reddit · 2026-09-07

开发者构建了一个基于 MiniMax H3 的实时交互视频场景:用户输入台词,车内角色在视频中开口回应并带生成音频,5 秒片段生成速度略快于实时播放。当前瓶颈是角色一致性,想训练角色 LoRA 锁定身份。

已掌握的信息与踩坑:

待解问题:base H3 上训练的角色 LoRA 能否迁移到蒸馏 checkpoint、能否与蒸馏 LoRA 叠加、T2I 静态数据是否足够保持说话时的面部稳定、多卡序列并行的实测数据。作者愿付费咨询有经验者。

所属事件:开发者实测 MiniMax H3 实时互动视频(2 条相关)→

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →