H3角色LoRA训练实测:相似度远不及Wan 2.2,附参数与避坑
Tiny-Highlight-9180 · reddit · 2026-09-09
Reddit用户分享训练H3角色LoRA的经验,结果不尽如人意。使用RTX 5090、musubi-tuner,60张图片,3000步,耗时约5小时。关键参数:networkdim/alpha=16,学习率1e-6,sigmoid时间步采样,EMA衰减0.999,blockstoswap=38。测试1500步和3000步,1500步效果差,3000步是基本要求。EMA与非EMA差异不大。其他发现:fl2va和ref2va是独立的,LoRA不通用;启用usepinnedmemoryforblockswap将每迭代时间从11.6秒降至6.1秒。作者表示相同数据集在Wan 2.2上效果更好,寻求改进建议。
「多模态」频道最新
- AI 视频编辑 agent 兴起:从生成内容转向执行工作流 — OwlZealousideal4779 · 2026-09-09
- AI 生成视频:猫咪在圣莫尼卡码头夕阳下过山车 — Born_History_8246 · 2026-09-09
- 腾讯混元开源语音模型 AuK:自然语言指令统一语音生成与编辑 — Tencent-Hunyuan · 2026-09-09
- 视频生成迭代太快,剧本还算正确的预制作产物吗 — tobowers · 2026-09-09
- ComfyUI 风格节点 NeonsStyleExplorer 更新:自建目录与风格库 — neonsparksuk · 2026-09-09
- 龙珠×学园孤岛跨界 AI 动画:风格混搭到最后一幕露馅 — Ok-Giraffe-8670 · 2026-09-09