SGF 用两阶段训练补上长视频外推的记忆梯度

Junhao Zhuang · hf · 2026-07-23

Self Gradient Forcing 为长视频外推补上“记忆写入”梯度

这篇论文指出,基于 Self Forcing 的自回归视频扩散训练虽然缓解了 exposure bias,但历史 KV cache 只是被当作冻结的 rollout 状态使用,后续损失无法反向指导“早先生成的 latent 应该怎样写入更有用的记忆”。作者把这称为 historical context-gradient gap。

方法:SGF 两阶段训练

结果

作者还表示会放出代码和模型。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →