Ling Xing 0003, Hongyu Qu, Rui Yan 0010, Xiangbo Shu, Jinhui Tang 0001. Locality-Aware Cross-Modal Correspondence Learning for Dense Audio-Visual Events Detection. IEEE Trans. Circuits Syst. Video Techn., 36(5):6838-6851, May 2026. [doi]
Abstract is missing.