新研究发现扩散 Transformer 早期已可读出图像内容
特拉维夫大学与康奈尔大学研究团队发布论文《Learning to Read the Contextual Tokens in Diffusion Transformers》,提出一个新框架来分析扩散 Transformer 生成过程。研究发现,在扩散模型生成的早期阶段,中间的 contextual tokens 就已经「读出」了大量尚未成形的图像信息,揭示了扩散 Transformer 在生成早期便编码了最终图像的关键内容。
2026-10-07 ~ 2026-10-07 · 2 条相关
- 论文:扩散 Transformer 生成早期即可读出大量图像信息 — kwangmoo_yi · 2026-10-07
- 新研究:扩散模型中间的 contextual tokens 已「读出」未成形图像内容 — kwangmoo_yi · 2026-10-07