Foveated Diffusion:仿人眼视觉的高效图像视频生成

CSProfKGD · x · 2026-08-26

介绍了一种名为 Foveated Diffusion 的新方法,旨在解决高分辨率图像和视频生成中注意力机制计算量随 token 数量二次扩展的问题。该方法受人类视觉系统启发,仅在视觉关注的区域分配高算力生成高分辨率像素,而在周边区域降低算力,从而显著提升生成效率。

原文链接 →

「多模态」频道最新

更多「多模态」频道 AI 资讯 →