Krea-2 Depth LoRA 发布:两阶段训练生成高质量图像深度图
JasonNickSoul · reddit · 2026-07-29
开发者发布了一款专为 Krea-2 模型设计的 Depth LoRA,能够将任意输入图像转化为高质量的深度图(Depth Map)。
该 LoRA 采用了两阶段渐进式分辨率训练策略:
- 阶段一(512分辨率预训练):在2000对公开数据集上训练,利用 VLM 重新生成描述以增强图文对齐,建立稳定的深度结构先验。
- 阶段二(1536高分辨率微调):专注于细节重建,优化边缘和精细几何结构,采用余弦学习率以稳定收敛。
使用注意:必须配合 ComfyUI-EditUtils 插件才能正常工作,建议输入图像最长边在 1024 至 2048 像素之间以获得最佳效果。
「多模态」频道最新
- Flux 3 用盗摄金属现场提示词追求粗粝真实感 — fofrAI · 2026-07-29
- 0.5B 参数的实时键盘控制视频模型已能交互运行 — multimodalart · 2026-07-29
- NVIDIA PDD 用 4–8 步蒸馏加速图像和视频生成 — nvidia · 2026-07-29
- VisoMaster 开源换脸工具支持图像视频与表情微调 — tom_doerr · 2026-07-29
- 用 img 2.0 生成的 Elon 与 Sam 对话梗图 — SkyNo7576 · 2026-07-29
- ComfyUI 0.29 增加流式视频与 GPT 5.6 节点 — pytraveler · 2026-07-29