Krea 2 角色 LoRA 控制变量实测:0.5 MP 是甜点,1.0 MP 反而过拟合
Cold-Worldliness5392 · reddit · 2026-09-28
作者在 RTX5090(runpod + Fizgig)上用同一套 35 张 Guy Fieri 数据集做了控制变量训练对比,四个变体:0.25/0.5/1.0 MP LoRA 与 0.5 MP LoKR(LoKR 仅把学习率从 5e-5 提到 1e-4),统一 20 epochs、同数据集/提示词/种子/推理流程,strength 1.0。
训练时间:0.25 MP 约 10 分钟,0.5 MP 约 18 分钟,1.0 MP 约 34 分钟,LoKR 约 23 分钟——即使最高分辨率也远快于旧的长时间训练流程。
核心发现:
- 0.25 MP 已经相当能打,超出「0.25 太低」的普遍预期,身份还原仍可用。
- 0.5 MP 是甜点:面部结构更好、细节更自然、相似度与灵活性平衡最佳。
- 1.0 MP 增加微细节的同时也更易过绑定数据集的风格包袱:头像素材里 0.25 MP 没项链、0.5 MP 有细链、1.0 MP 出现大钻石绳——模型学的不只是身份,还有「Guy Fieri 视觉全套」,更趋漫画化。结论:更多细节不等于更好的身份学习。
- LoKR 表现亮眼:比 1.0 MP LoRA 保留更多细节结构又避免漫画化,比 0.5 MP LoRA 略精致。
生产建议:0.5 MP + 20 epochs + rank 8 LoRA 作基线,0.5 MP LoKR 值得继续测试。作者计划在另一角色上复验结论。
「多模态」频道最新
- 开发者用 Vision Pro 实时把房间变成吉卜力风格,惊呼 GPT-6 Astra — Scobleizer · 2026-09-28
- 给 Claude 接上 MCP 自由创作,一句话搞定动态图形视频 — aziz4ai · 2026-09-28
- 光影咒语:一段氛围感 AI 视频演示 — piotrbinkowski · 2026-09-28
- AI 视频电影感技巧大全:运镜、构图、打光全带 prompt 示例 — zetarediculi · 2026-09-28
- 用户用 Claude Opus 5.5 动效技能给自己的网站做了片头动画 — VIV-AF-D · 2026-09-28
- Opus 5.5 实测:游戏 demo 与生成视频质量首度达到可用阈值 — Dr_Singularity · 2026-09-28