FreeStyle 挖社区 LoRA,提升风格内容双参考生成
jiqizhixin · x · 2026-07-27
来自复旦大学、StepFun、香港大学和西湖大学的研究者提出 FreeStyle,目标是在生成图像时同时满足「风格参考」和「内容参考」,并尽量避免风格与内容互相串扰。
- 他们从社区里现成的 LoRA 中挖掘样本,构建了一个大规模的干净风格-内容配对数据集。
- 方法上采用两阶段训练,并结合注意力与频域技巧,降低风格泄漏,同时尽量保留内容细节。
- 在风格迁移和双参考生成基准上,FreeStyle 在风格对齐、内容保持、泄漏抑制之间取得了更好的平衡,整体优于已有方法。
- 论文题目是《FreeStyle: Free Control for Style–Content Dual-Reference Generation from Community LoRA Mining》。
「多模态」频道最新
- Maginary 新增 GPT-Images2 支持,并预告 MCP 与 x402 — lutian · 2026-07-27
- 创作者用 RunwayML 从零做完一支音乐视频只花 4 小时 — notiansans · 2026-07-27
- LoRA 能让图像模型更像“普通人”而非完美脸吗 — baben7 · 2026-07-27
- ComfyUI 用户求一套更简单的照片与姿势编辑工作流 — jd142 · 2026-07-27
- 用 numpy 和 PIL 画出 26 个年龄态的时间之蕨 — repligate · 2026-07-27
- LinkSpotlight 给 ComfyUI 加了 Alt+H 专注模式 — dingsl771 · 2026-07-27