Krea 2 做 LoRA 训练 16GB 显存够用,但会泄漏到无触发词提示
Economy_Cucumber_702 · reddit · 2026-07-29
这是一篇很细的 Krea 2 LoRA 训练实测,结论很直接:16GB 显存足够做 768px 训练,和外面流传的说法不一致。
关键结果
- 总共训练 1,152 steps,耗时 67 分钟,速度约 3.42 s/it
- 峰值显存占用达到 15,284 / 16,303 MiB,也就是 93.8%
- 系统内存峰值约 17.5GB / 32GB
- 训练后切到 Turbo 推理,8 steps 生成一张 768×1024 图片大约 13 秒
环境与栈
- GPU:RTX 5080 16GB,CPU:Ryzen 9 9950X
- 系统是 Windows 11 原生,没有用 WSL2
- 训练栈包括 torch 2.13.0+cu130、accelerate 1.6.0、transformers 4.57.6、diffusers 0.32.1、bitsandbytes 0.50.0、musubi-tuner 0.3.4
- 注意力后端只用了 SDPA,没有 Triton、flash-attn、xformers 或 SageAttention
模型与文件说明
- Krea 2 的结构里,文本编码器是 Qwen3-VL-4B-Instruct,VAE 是 Qwen-Image VAE
- 训练要用 RAW bf16,推理用 Turbo bf16
- 官方 Hugging Face 仓库是 gated 的,但 Comfy-Org/Krea-2 镜像是开放的,而且 RAW 文件字节级一致
- 预量化的 fp8 Turbo 文件是给 ComfyUI 用的,直接喂给 musubi 会因为多出来的键而加载失败
额外问题
作者还指出,这个 LoRA 有一个实际缺陷:它会泄漏到无触发词提示里,而且换更早 checkpoint 或降低 multiplier 都没解决。帖子只有单次运行,没有做 ablation,所以更适合当作实践报告看。
所属事件:Krea 2 LoRA 本地训练门槛大降:11GB 显存即可跑(5 条相关)→
「模型」频道最新
- 网友称 Claude Opus 5.5 视觉设计能力为测试过的模型中最佳 — _sholtodouglas · 2026-09-23
- 网友实测称未发布的 Claude Opus 5.5 视觉设计能力最强 — MickeySteamboat · 2026-09-23
- Anthropic 团队成员称已修复 Opus 5.5 的写作能力 — dreamwieber · 2026-09-23
- 继续实测:6 个 luna 模型照图作画,结果出乎意料地不差 — adonis_singh · 2026-09-23
- 用 computer use 让模型照参考图作画,Opus 与 Astra 实测对比 — adonis_singh · 2026-09-23
- AI 玩狼人杀说服众人投出对手,最终获胜 — pbbakkum · 2026-09-23