D-OPCD 把 Agent 经验蒸馏进扩散模型权重,四基准平均分升至 65.09

Wenxuan Wang · hf · 2026-10-08

用 agent harness 包裹图像生成模型可显著提升文生图效果(记忆、技能、工作流编排、结果验证与迭代改写 prompt),但这些增益依附于 harness。论文提出 Diffusion On-Policy Context Distillation(D-OPCD):把 agent 改进后的 prompt 视作特权上下文,将 harness 中的知识蒸馏进扩散模型权重,使模型仅凭原始 query 也能保留部分增益。

要点:

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →