Oxygen-TryOn 以时尚原生模型做多件虚拟试衣
JD-company · hf · 2026-07-28
京东团队发布了 Oxygen-TryOn,一个面向任意单品虚拟试衣的 fashion-native 基础模型。
- 它不是把通用图像编辑器拿来“顺手做试衣”,而是为试衣任务专门设计的模型。
- 输入可以是一件或多件参考单品,以及一张目标人物图,模型会合成人物穿着这些单品的写实图像。
- 覆盖的品类很广,包括服装、外套、配饰、鞋履、包袋等。
- 它支持全身/半身视角、可变数量参考图,以及自由组合多件单品。
- 训练上用了一个大规模数据引擎,再配合 CPT / SFT / RL 三阶段流程。
- 其中 RL 阶段采用混合 reward,把内部试衣 reward model 和 rubric-guided 的通用模型结合起来。
- 作者声称它在公开基准和内部基准上都达到了很强的 consistency 和 realism,尤其在 multi-item try-on 上对比 Nano Banana Pro、GPT-Image-2、Seedream5 Lite、FLUX.2 等系统表现突出。
「多模态」频道最新
- 用户分享一个 Midjourney 新风格及其提示词参数 — azed_ai · 2026-07-28
- 120 张标注图训练出一个 5MB 的 McBess 风格 LoRA — Winter_unmuted · 2026-07-28
- TopviewAI 推出 Film Studio,支持 3D 分镜和微表情控制 — XFreeze · 2026-07-28
- GaussianGPT 用自回归 next-token 生成 3D Gaussian 场景 — rsasaki0109 · 2026-07-28
- 图像生成避坑:如何正确测试混合了画风的角色LoRA — Dark_Sytze · 2026-07-28
- FilmBench 用电影学院 shot list 评测视频生成 — Shengyi Wang · 2026-07-28