← Search

Connor Ding

2 accepted papers

2026

GaussianVision: Vision-Language Alignment from Compressed Image Representations using 2D Gaussian Splatting

CVPR 2026

Modern vision-language pipelines are driven by RGB vision encoders trained on massive image-text corpora. While these pipelines have enabled impressive zero-shot capabilities and strong transfer across tasks, they still inherit two structural inefficiencies from the pixel domain: (i) transmitting de

Cited by 0SourceScholar
2025

ItDPDM: Information-Theoretic Discrete Poisson Diffusion Model

NeurIPS 2025poster

Generative modeling of non-negative, discrete data, such as symbolic music, remains challenging due to two persistent limitations in existing methods. Firstly, many approaches rely on modeling continuous embeddings, which is suboptimal for inherently discrete data distributions. Secondly, most model…

Cited by 0SourceScholar