Marigold V2 用 4-bit QLoRA 微调 Qwen-Image-Edit,单卡数日搞定稠密预测
RexDouglass · x · 2026-09-14
社区传出扩散 Transformer 转用于稠密预测的新作 Marigold V2:
- 以 Qwen-Image-Edit-2509 为底座,做 4-bit 量化 + Rank-128 QLoRA 微调
- 深度、法线、反照率等可在一步(one-step)内完成估计
- 单张 GPU 数天即可完成训练,大幅降低门槛
- 作者还暗示了与 STeR 结合、扩展到视频任务的可能性
对想在消费级单卡上复现稠密预测模型的开发者是条低成本路线。
「多模态」频道最新
- AI 从单一视频生成任意机位视角,含未拍摄角度 — TheMoonMidas · 2026-09-14
- 网友给 ChatGPT 完全创作自由,让它画一张细节最密集的图 — NVDA808 · 2026-09-14
- 开源 stage-gen 实测:自动绑定骨骼仍会在动画中变形翻车 — softmarshmallow · 2026-09-14
- 用「GPT-6 Astra」加 fal 相机控制复刻童年漫画英雄 — OdinLovis · 2026-09-14
- 网友用 Claude 把游戏 wiki 改写成 15 万字小说,再用 GPT 互审配音 — HighSeasArchivist · 2026-09-14
- 商汤发布 SenseNova-U1.5:8B 无编码器统一模型实现理解生成一体 — KyeGomezB · 2026-09-14