求助:训练WAN 2.2视频LoRA时文本标签怎么写?
Overall-Reporter-440 · reddit · 2026-08-03
用户在使用 Musubi Tuner 为 WAN 2.2 图生视频模型训练 LoRA 时遇到困难。他按照常规理解,在视频对应的 .txt 文件中详细描述了视频中的动作(如“一个男人向老人扔番茄并溅开,引发大笑”),并加上了触发词。
然而,在训练 1000 步后,他在 ComfyUI 中测试发现加载与不加载 LoRA 的效果几乎没有差异。他向社区求助,询问这种文本标签的撰写方式是否存在问题或误区。
「多模态」频道最新
- 开发者分享 gabor_painter 模型架构探索与笔触预测实践 — pixlpa · 2026-08-03
- 实测 MiniMax H3 视频模型:2-4 分钟生成,速度与画质俱佳 — infroy28 · 2026-08-03
- 观点:AI 生成灾难片效果将比实景拍摄更真实 — JourneymanChina · 2026-08-03
- 同提示词出图对比:REVE 2.1 与 Meta AI 效果一览 — LudovicCreator · 2026-08-03
- 英伟达 SANA-Video 2.0:单卡 5090 生成 720p 视频 — mmowg · 2026-08-03
- 使用海螺AI创作奇幻电影预告片 — menhguin · 2026-08-03