求助:训练真实感虚拟网红 LoRA 遇到数据集过拟合与一致性难题
Capable-Swim318 · reddit · 2026-09-01
用户在尝试使用 ComfyUI 创建高真实感的虚拟网红并训练 LoRA 时面临挑战。目标是保持角色在不同图像中的一致性,同时像真人一样自然。主要问题在于数据集准备:初始数据集虽然表情和姿势多变,但服装和背景过于单一,担心 LoRA 会将衣服和场景误认为角色身份的一部分导致过拟合;尝试使用 Qwen-Image-Edit 增加服装和场景多样性后,图像出现了明显的“塑料”AI 感,且角色一致性下降。用户寻求关于如何平衡数据集一致性、多样性以及保持真实感的建议。
「多模态」频道最新
- 质疑 Minimax H3 混合模型:参考图遵循能力弱于预期 — Tablaski · 2026-09-01
- ABot-Recon 上线 Hugging Face:行车记录仪视频几秒变 3D 扫描 — petewoodbridge · 2026-09-01
- KATok 自适应视频 tokenizer:丢弃冗余 token 压缩视频表征 — kakaocorp · 2026-09-01
- DICS:利用数据内在一致性筛选视觉指令数据 — SpatialAxiom · 2026-09-01
- 实测:实时无标记动作捕捉,延迟低至百毫秒 — petewoodbridge · 2026-09-01
- AI 音乐视频生成仍较难:寻找懂氛围的工具 — _laundpana · 2026-09-01