给 LoRA 加上 3D 身体扫描
tekprodfx16 · reddit · 2026-07-14
作者 fork 了 **AI Toolkit**,加了一个基于 **SAM 3D Body** 的第二阶段训练,让 LoRA/LoKr 不只学脸,还能更好地学到身体形状和比例。 他的思路是: 1. 先做普通 LoRA/LoKr 训练,学习触发词和参考照片 2. 再让模型生成图像,用 SAM 3D 扫描生成结果里的身体 3. 用“真实 3D 身体读数”去约束训练,而不是只靠像素和 caption 猜测 作者说这能明显改善 **full-body likeness**,在 Krea 2 上可用;脸部训练约 30 分钟,加入 SAM 3D 身体后大约 60 分钟。仓库是 `FedorAiToolkit`,SAM 3D Body 模型在 Hugging Face 上需要 gated access。
所属事件:结合SAM 3D进行LoRA训练精准还原全身像(2 条相关)→
「多模态」频道最新
- Grok Imagine 的 Agent mode 新增裁切功能,方便做视频转场 — elonmusk · 2026-07-21
- Fable 生成歌曲时会自动检查 dB,防止听感过炸 — Sauers_ · 2026-07-21
- Gaussian splat 把旧金山大教堂做成 3D 场景 — ciguleva · 2026-07-21
- ComfyUI 基准显示 NVFP4 可加速 Flux 和 Qwen-Image 等模型 — Certain-Will-2769 · 2026-07-21
- Midjourney 发出一组超现实时尚生成图 — ciguleva · 2026-07-21
- Grace Cathedral 做成了空地融合的互动 3D 扫描 — nptacek · 2026-07-21