8 讲浓缩斯坦福扩散模型课:全程只画一只泰迪熊

le_james94 · x · 2026-09-22

James Le 发布了 Stanford CME 296《扩散与大视觉模型》全部 8 讲(Afshine 与 Shervine Amidi 双胞胎兄弟讲授,约 14 小时视频)的浓缩整理。课程以「一只泰迪熊看书」的同一 prompt 贯穿 8 讲:从噪声 blob 到成图,逐层拆开 prompt 经过的每个环节——自编码器、去噪 transformer、guidance scale、评测基准,顺序覆盖 DDPM、score matching/SDE、flow matching、latent space、架构、训练、评测与领域走向。

作者还提出两个观点:

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →