ETVA: Evaluation of Text-to-Video Alignment via Fine-Grained Question Generation and Answering

Kaisi Guan, Zhengfeng Lai, Yuchong Sun, Peng Zhang, Wei Liu, Kieran Liu, Meng Cao, Ruihua Song. ETVA: Evaluation of Text-to-Video Alignment via Fine-Grained Question Generation and Answering. In IEEE/CVF International Conference on Computer Vision, ICCV 2025, Honolulu, HI, USA, October 19-25, 2025. pages 21299-21309, IEEE, 2025. [doi]

Abstract

Abstract is missing.