← Search

Baoyou Chen

3 accepted papers

2026

Head-wise Adaptive Rotary Positional Encoding for Fine-Grained Image Generation

CVPR 2026

Transformers rely on explicit positional encoding to model structure in data. WhileRotary Position Embedding (RoPE) excels in 1D domains, its application to image generation reveals significant limitations such as fine-grained spatial relationmodeling, color cues, and object counting. This paper ide

Cited by 0SourcecodeScholar
2025

Dirichlet-Constrained Variational Codebook Learning for Temporally Coherent Video Face Restoration

ICCV 2025poster

Video face restoration faces a critical challenge in maintaining temporal consistency while recovering fine facial details from degraded inputs. This paper presents a novel approach that extends Vector-Quantized Variational Autoencoders (VQ-VAEs), pretrained on static high-quality portraits, into a…