Marigold V2 发布:单张消费级 GPU 训练的 DiT 深度估计器
AntonObukhov1 · x · 2026-09-09
Marigold V2(将发表于 SIGGRAPH Asia 2026)发布。V1 的思路是把图像生成器后训练成深度估计器,单 GPU 即可完成,走「人人可做的研究」路线;V2 升级为扩散 Transformer(DiT),边缘极锐利,且相当通用,覆盖深度、表面法线、反照率等多种模态。论文、代码、权重和 Demo 均已开放。
所属事件:Marigold V2 发布:单卡微调 DiT 做深度估计(5 条相关)→
「多模态」频道最新
- CapCut 桌面版接入 Seedance 2.5:单次生成 30 秒视频 — future_coded · 2026-09-09
- 组合两种 Seedance 2.5 提示词技巧,一条长镜头做出多镜头剪辑效果 — techhalla · 2026-09-09
- 100 个规则验证器加 300 项任务,团队为视频模型打造可验证 RL 训练配方 — DanielKhashabi · 2026-09-09
- 博主称 H3 MAX 配对提示词可当渲染引擎,预告放出实操演示 — gorkem · 2026-09-09
- Gradium 发布 Voice Design:一句话描述即生成配音声线 — ThePeterMick · 2026-09-09
- 用「GPT 6 Astra」在 Spline 里做行走会自纠碰撞的机器人 — dunkhippo33 · 2026-09-09