2026
From Talking to Singing: A New Challenge for Audio-Visual Deepfake Detection
ICML 2026poster
With rapid advances in audio-visual generative models, reliable forgery detection becomes increasingly critical. Existing methods for audio-visual deepfake detection typically rely on cross-modal inconsistencies. In singing, rhythmic vocalization weakens this coupling and introduces a nontrivial dom…