求助:训练WAN 2.2视频LoRA时文本标签怎么写?

Overall-Reporter-440 · reddit · 2026-08-03

用户在使用 Musubi Tuner 为 WAN 2.2 图生视频模型训练 LoRA 时遇到困难。他按照常规理解,在视频对应的 .txt 文件中详细描述了视频中的动作(如“一个男人向老人扔番茄并溅开,引发大笑”),并加上了触发词。

然而,在训练 1000 步后,他在 ComfyUI 中测试发现加载与不加载 LoRA 的效果几乎没有差异。他向社区求助,询问这种文本标签的撰写方式是否存在问题或误区。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →