Stanford CS25: V5 I Transformers in Diffusion Models for Image Generation and Beyond
Stanford Online · 74:32
Sayak Paul’s CS 25 lecture is an architecture-first tour of modern image (and video) generators: how latent diffusion / flow-matching systems are assembled, why UNets were abandoned for Diffusion Transformers (DiTs),...