给蒸馏 critic 喂真实照片,Krea2 LoRA 两步出图仍清晰
TimeTruth2490 · reddit · 2026-08-28
社区训练者分享 Krea 2 Turbo 蒸馏 LoRA 的中期进展:在原有 Progressive Distillation 基础上引入 latent 空间的 GAN critic(LADD 式 Latent Adversarial Diffusion Distillation),关键改动是 critic 的「真实参考」不只来自教师模型输出,还部分喂入真实照片,这带来了惊人的鲁棒性。代价是训练慢 2-3 倍。critic 仅存在于训练期,发布后的 LoRA 仍是即插即用文件。
极端实验:将该 LoRA 在远超训练规格(4 步)的条件下运行——仅 2 步、strength 2——与原生 Krea 2 Turbo 同参数对比:原生模型输出鬼影、涂抹、半成品图像,而 LoRA 侧在全部 15 个测试提示词上都给出连贯清晰构图。作者强调这不适合生产,但可作快速预览:2 步即可判断构图与整体观感,成本约为 8 步的 1/4;近景/人像效果最好,远景(如市场场景)会变差。基于此结果,作者正考虑立项训练真正的 2 步 LoRA。对比图已上传 Hugging Face。
「多模态」频道最新
- 创作者用 AI 将自己变身机甲动漫主角 — JBOOGZEE · 2026-08-28
- 用户实测 Minimax H3:动作控制难达标 — cal_01 · 2026-08-28
- 沙特摄影师称已完全用 Google Veo 拍摄 — aziz4ai · 2026-08-28
- 开发者分享 Blender 到 Unity 的场景管线实践 — kevinkern · 2026-08-28
- Seedance 2.5登顶动态视频榜,胜率超Gemini与Grok — yuwen_lu_ · 2026-08-28
- MiniMax H3 社区日报:绘画逆向生成、PDD 加速、音频修复 — optimisticalish · 2026-08-28