Krea 2 做 LoRA 训练 16GB 显存够用,但会泄漏到无触发词提示
Economy_Cucumber_702 · reddit · 2026-07-29
这是一篇很细的 Krea 2 LoRA 训练实测,结论很直接:16GB 显存足够做 768px 训练,和外面流传的说法不一致。
关键结果
- 总共训练 1,152 steps,耗时 67 分钟,速度约 3.42 s/it
- 峰值显存占用达到 15,284 / 16,303 MiB,也就是 93.8%
- 系统内存峰值约 17.5GB / 32GB
- 训练后切到 Turbo 推理,8 steps 生成一张 768×1024 图片大约 13 秒
环境与栈
- GPU:RTX 5080 16GB,CPU:Ryzen 9 9950X
- 系统是 Windows 11 原生,没有用 WSL2
- 训练栈包括 torch 2.13.0+cu130、accelerate 1.6.0、transformers 4.57.6、diffusers 0.32.1、bitsandbytes 0.50.0、musubi-tuner 0.3.4
- 注意力后端只用了 SDPA,没有 Triton、flash-attn、xformers 或 SageAttention
模型与文件说明
- Krea 2 的结构里,文本编码器是 Qwen3-VL-4B-Instruct,VAE 是 Qwen-Image VAE
- 训练要用 RAW bf16,推理用 Turbo bf16
- 官方 Hugging Face 仓库是 gated 的,但 Comfy-Org/Krea-2 镜像是开放的,而且 RAW 文件字节级一致
- 预量化的 fp8 Turbo 文件是给 ComfyUI 用的,直接喂给 musubi 会因为多出来的键而加载失败
额外问题
作者还指出,这个 LoRA 有一个实际缺陷:它会泄漏到无触发词提示里,而且换更早 checkpoint 或降低 multiplier 都没解决。帖子只有单次运行,没有做 ablation,所以更适合当作实践报告看。
「模型」频道最新
- Apple 据称起诉 OpenAI,指控未来硬件相关商业秘密被盗用 — emmanuelvivier · 2026-07-29
- Kimi K3 和 Qwen3.8 证明中国 AI 已成持续竞争力量 — emmanuelvivier · 2026-07-29
- GPT-5.6 据称解开概率论长期开放问题 Feige 猜想 — MickeySteamboat · 2026-07-29
- Kimi K3 Q2 传出可在两台 512GB M3 Ultra Mac Studio 本地运行 — pcuenq · 2026-07-29
- 脑洞大开:Gemini 硬将数学谜语解读为 9/11 恐袭地狱笑话 — TourPsychological800 · 2026-07-29
- 开源权重不等于开源代码,许可证比榜单更影响采用 — shashib · 2026-07-29