2022
Diverse Audio Captioning Via Adversarial Training
ICASSP 2022accepted
Audio captioning aims at generating natural language descriptions for audio clips automatically. Existing audio captioning models have shown promising improvement in recent years. However, these models are mostly trained via maximum likelihood estimation (MLE), which tends to make captions generic,…