500 张图训出的 SD1.5 LoRA 人脸全崩,作者求助诊断
Available_Fondant_11 · reddit · 2026-09-08
一位学生项目作者用 500 张 Openverse API 抓取的开放版权图片(BLIP 自动打标 + 触发词前缀),基于 SD1.5 训练 rank 8 LoRA(1e-4 学习率、约 1500 步、512 分辨率),用于生成乌干达本地化健康教育插画。
问题:生成结果中背景、服装、场景都正常,唯独人脸扭曲失真;叠 comic checkpoint 排除了底模不匹配,img2img 不用 LoRA 时人脸正常,指向 LoRA 训练本身。
其猜测:未做数据筛选,大量小脸、侧脸、合影、低分辨率图污染训练集。求证是否还有其他常见原因(rank/步数配比、过拟合、BLIP 标注质量等)以及人脸数据集的筛选最佳实践。
「多模态」频道最新
- Seedance 2.5 工作流演示:3D 场景渲染视频后再用对话式后期改片 — ZabihullahAtal · 2026-09-08
- 一人跑通全自动流水线:同一首歌批量生成 1000 支 MV — Lucky_Feedback9915 · 2026-09-08
- RX 9070 XT 跑 ComfyUI 稳定方案:预热后出图仅 12-16 秒 — OrionNebulae · 2026-09-08
- 可灵 AI 宣布参展多伦多电影节市场,将办 AI 视频创作论坛 — aziz4ai · 2026-09-08
- 用 MiniMax H3 打造可交互辐射世界模型:WASD 走位+LLM 反应 — -Ellary- · 2026-09-08
- AI 视频越逼真,运镜与物理可信度短板越明显 — ZabihullahAtal · 2026-09-08