2026
SpotEdit: Selective Region Editing in Diffusion Transformers
CVPR 2026
Diffusion Transformer (DiT)-based models have significantly advanced image editing by encoding conditional images and integrating them into transformer layers. However, most edits involve modifying only small regions, while current methods uniformly process and denoise all tokens at every timestep,