← Search

Ruishu Zhu

2 accepted papers

2026

ViewMask-1-to-3: Multi-View Consistent Image Generation via Multimodal Diffusion Models

ICML 2026poster

Motivated by discrete diffusion's success in language-vision modeling, we explore its potential for multi-view generation, a task dominated by continuous approaches. We introduce \textbf{ViewMask-1-to-3}, formulating multi-view synthesis as a discrete sequence modeling problem where each viewpoint i…

Cited by 0SourceScholar