RAISE: Requirement-Adaptive Evolutionary Refinement for Training-Free Text-to-Image Alignment
Recent text-to-image (T2I) diffusion models achieve remarkable realism, yet faithful prompt-image alignment remains challenging, particularly for complex prompts with multiple objects, relations, and fine-grained attributes. Existing training-free inference-time scaling methods rely on fixed iterati