Stanford CS25: V5 I Transformers in Diffusion Models for Image Generation and Beyond

Stanford Online · 74:32

Sayak Paul’s CS 25 lecture is an architecture-first tour of modern image (and video) generators: how latent diffusion / flow-matching systems are assembled, why UNets were abandoned for Diffusion Transformers (DiTs),...

Read the full summary on tuber

Redirecting...