首练 Krea2 日系写真 LoRA:9000 张图+完整训练参数全公开
Zealousideal_Knee_50 · reddit · 2026-10-06
作者分享首个自训 LoRA:将 Krea 2 推向日本写真集风格(真实相机皮肤质感、柔光窗光、酒店/旅馆/泳池等场景),并完整公开训练与使用细节。
用法
- 触发词 wmasianmodel 放提示词最前;单独用权重 0.8–1.0,叠加角色 LoRA 时 0.6–0.8(角色 LoRA 先加载、权重 0.8–1.0)
- 数据集用自然语言长段标注,提示词建议按「构图→机位→姿势→表情→发型→服装面料→光线→环境」顺序写完整句子
训练配置
- 约 9000 张写真照片,先用 VLM 生成 120–220 词结构化描述,训练前裁掉水印/网址条
- ai-toolkit 在 Krea 2 Raw 上训练:rank 32 / alpha 32,lr 1e-4(adamw8bit),batch 1×accum 2,10k 步,flowmatch + linear timesteps,512/768/1024 buckets,caption dropout 0.05
已知局限:强偏向东亚女性与室内/度假场景;手脚仍是 Krea 2 原生水平,需详细姿势描述;是风格不是身份,需叠角色 LoRA 才能固定脸。另附两遍精修(two-pass refine)工作流链接。18+ 内容。
「多模态」频道最新
- ComfyUI 队列卡死排障清单:先分清校验失败还是进度丢失 — fluxdraw · 2026-10-06
- 首次用 Seedance 2.5 生成视频,结尾文字惨遭「鬼画符」 — atomantsmasher · 2026-10-06
- OneCanvas:一张图让普通图像模型学会3D空间推理,登顶SOTA — Roger_M_Taylor · 2026-10-06
- WM-VLM:让内部世界模型生成视觉中间态提升空间推理 — ZhitingHu · 2026-10-06
- ProAR:让自回归视频模型学会预判结果的前瞻推理框架 — muhao_chen · 2026-10-06
- 斯坦福 SPEED 论文入选 NeurIPS:免训练加速扩散生成约 2 倍 — hsu_byron · 2026-10-06