Marigold V2 发布:单 GPU 后训练图像生成器做深度估计,入选 SIGGRAPH Asia 2026
AntonObukhov1 · x · 2026-09-09
Anton Obukhov 宣布 Marigold V2 发布,已被 SIGGRAPH Asia 2026 接收。
- V1 回顾:Marigold 的思路是把一个图像生成模型后训练成深度估计器,仅需一张 GPU 即可完成,是「平民化」的研究路线。
- V2 升级:骨干换成扩散 Transformer(DiT),边缘非常锐利,且通用性更强。
配套的论文、代码、权重和在线 demo 均已放出,作者还单独说明了低成本复现路径(4-bit 量化 + QLoRA 单卡微调)。
所属事件:Marigold V2 发布:单卡微调 DiT 做深度估计(5 条相关)→
「多模态」频道最新
- CapCut 桌面版接入 Seedance 2.5:单次生成 30 秒视频 — future_coded · 2026-09-09
- 组合两种 Seedance 2.5 提示词技巧,一条长镜头做出多镜头剪辑效果 — techhalla · 2026-09-09
- 100 个规则验证器加 300 项任务,团队为视频模型打造可验证 RL 训练配方 — DanielKhashabi · 2026-09-09
- 博主称 H3 MAX 配对提示词可当渲染引擎,预告放出实操演示 — gorkem · 2026-09-09
- Gradium 发布 Voice Design:一句话描述即生成配音声线 — ThePeterMick · 2026-09-09
- 用「GPT 6 Astra」在 Spline 里做行走会自纠碰撞的机器人 — dunkhippo33 · 2026-09-09