Mllm-guided hierarchical semantic ensemble with adaptive visual fusion for zero-shot composed video retrieval

Yiping Meng, Lilong Liu, Man Wu, Zhixiang Ding, Shengsheng Qian. Mllm-guided hierarchical semantic ensemble with adaptive visual fusion for zero-shot composed video retrieval. Multimedia Syst., 32(5):325, July 2026. [doi]

Abstract

Abstract is missing.