← Search

Joshua Atkins

1 accepted papers

2025

ImmerseDiffusion: A Generative Spatial Audio Latent Diffusion Model

ICASSP 2025accepted

We introduce ImmerseDiffusion, an end-to-end generative audio model that produces 3D immersive soundscapes conditioned on the spatial, temporal, and environmental conditions of sound objects. ImmerseDiffusion is trained to generate first-order ambisonics (FOA) audio, which is a conventional spatial…

Cited by 0SourceScholar