Adobe FlowTool 用流匹配直接生成修图参数,延迟降低 50 倍
adobe-research · hf · 2026-09-29
Adobe Research 提出 FlowTool,把基于工具的图像修图从自回归 MLLM 推理改造成流匹配问题:视觉-语言模型负责多模态理解,DiT 参数生成器将高斯噪声转化为编辑参数,用两阶段监督流匹配课程训练并辅以奖励后训练。
- 在 MMArt-Bench、FlowTool-Eval、ArtEdit-Bench 与 MIT-Adobe5K 上,参考指标显著优于专门 MLLM 修图 agent 和专有 MLLM
- 无参考评估下与专有模型相当
- 推理延迟至少降低 50 倍,内存占用约减半
结论:结构化连续编辑参数可直接作为条件生成建模,无需自回归推理。
「多模态」频道最新
- Seedance 2.5 单条提示词生成霍比特人村庄版自拍 vlog — techhalla · 2026-09-29
- 用 AI 做「匹配剪辑」:同一动作里换装、换场景保运动连续性 — ArcaArtificial · 2026-09-29
- invideo 推出 agentic 视频编辑器:看懂素材、一句话改全时间线 — azed_ai · 2026-09-29
- 网友用 Opus 5.5 迭代出一整期节目:无法一键成型但效果满意 — weakcper · 2026-09-29
- MiniMax H3 动画版《指环王》演示引关注 — azed_ai · 2026-09-29
- Krea 2 LoRA 训练指南混乱:Raw 还是 Turbo、训练器怎么选? — Sweaty_Painting1978 · 2026-09-29