Marigold V2 训练配方:4bit 量化 DiT 加 QLoRA 单卡微调
AntonObukhov1 · x · 2026-09-09
Marigold V2 的训练配方延续了「反常规但有效」的传统:V1 曾把深度图直接塞进图像 VAE(理论上不该 work 但 work 了);V2 则把真值深度通过 DINOv3 编码,并将 DiT 特征与之对齐(iREPA-depth)。具体做法:取大型预训练 DiT(Qwen-Image-Edit-2509),量化到 4bit,加 rank-128 的 QLoRA,在一张 32GB 消费级 GPU 上微调——几小时出可用深度,几天完成训练,无需 80GB 卡或多节点。推理为单步,2K 分辨率也不会 OOM。
所属事件:Marigold V2 发布:单卡微调 DiT 做深度估计(5 条相关)→
「Infra」频道最新
- 芯片创企 Fab2 融资 5 亿美元,估值达 37 亿 — Sethwinterroth · 2026-09-09
- Base Power 联创长谈:AI 时代的电力需求与能源创业课 — espricewright · 2026-09-09
- 存储芯片短缺持续到 2027 年底,印度智能手机集体涨价 — saibharadwaj · 2026-09-09
- Inception 发布 Mercury 2.5:最强扩散 LLM,1107 tokens/秒、26 万上下文 — StefanoErmon · 2026-09-09
- 仅交换两层循环顺序,Intel 演示矩阵乘法提速 27 倍 — jedisct1 · 2026-09-09
- AWS实测G7 Blackwell实例:30B MoE推理比G5/G6更省更快 — AWS ML Blog · 2026-09-09