Yuchen Hu, Chen Chen, Ruizhe Li, Heqing Zou, Eng Siong Chng: MIR-GAN: Refining Frame-Level Modality-Invariant Representations with Adversarial Network for Audio-Visual Speech Recognition. ACL (1) 2023: 11610-11625