REPA Works Until It Doesn’t: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
attention mapscapacity mismatchdenoisingdiffusion transformersefficient diffusion trainingfeature projectionsgenerative capacitygenerative teacherhidden featuresholistic alignment lossjoint data distributionone-shot terminationoptimization stepsrepresentation alignmentsemantic anchorstext-to-image
Diffusion Transformers (DiTs) deliver state-of-the-art image quality, yet their training remains notoriously slow. A recent remedy