← Search

Jaihoon Kim

6 accepted papers

2025

Inference-Time Scaling for Flow Models via Stochastic Generation and Rollover Budget Forcing

NeurIPS 2025poster

We propose an inference-time scaling approach for pretrained flow models. Recently, inference-time scaling has gained significant attention in LLMs and diffusion models, improving sample quality or better aligning outputs with user preferences by leveraging additional computation. For diffusion mode…

Cited by 0SourceScholar
2025

Moment- and Power-Spectrum-Based Gaussianity Regularization for Text-to-Image Models

NeurIPS 2025poster

We propose a novel regularization loss that enforces standard Gaussianity, encouraging samples to align with a standard Gaussian distribution. This facilitates a range of downstream tasks involving optimization in the latent space of text-to-image models. We treat elements of a high-dimensional samp…

Cited by 0SourceScholar
2025

StochSync: Stochastic Diffusion Synchronization for Image Generation in Arbitrary Spaces

ICLR 2025poster

We propose a zero-shot method for generating images in arbitrary spaces (e.g., a sphere for 360◦ panoramas and a mesh surface for texture) using a pretrained image diffusion model. The zero-shot generation of various visual content using a pretrained image diffusion model has been explored mainly in…

Cited by 0SourcePDFScholar
2024

SyncTweedies: A General Generative Framework Based on Synchronized Diffusions

NeurIPS 2024poster

We introduce a general diffusion synchronization framework for generating diverse visual content, including ambiguous images, panorama images, 3D mesh textures, and 3D Gaussian splats textures, using a pretrained image diffusion model. We first present an analysis of various scenarios for synchroniz…

2023

Paired-Point Lifting for Enhanced Privacy-Preserving Visual Localization

CVPR 2023poster

Visual localization refers to the process of recovering camera pose from input image relative to a known scene, forming a cornerstone of numerous vision and robotics systems. While many algorithms utilize sparse 3D point cloud of the scene obtained via structure-from-motion (SfM) for localization, r…