HSVLT: Hierarchical Scale-Aware Vision-Language Transformer for Multi-Label Image Classification - researchr publication

researchr

You are not signed in
Sign in
Sign up

Shuyi Ouyang, Hongyi Wang, Ziwei Niu, Zhenjia Bai, Shiao Xie, Yingying Xu, Ruofeng Tong 0001, Yen-Wei Chen 0001, Lanfen Lin. HSVLT: Hierarchical Scale-Aware Vision-Language Transformer for Multi-Label Image Classification. In Abdulmotaleb El-Saddik, Tao Mei, Rita Cucchiara, Marco Bertini 0001, Diana Patricia Tobon Vallejo, Pradeep K. Atrey, M. Shamim Hossain, editors, Proceedings of the 31st ACM International Conference on Multimedia, MM 2023, Ottawa, ON, Canada, 29 October 2023- 3 November 2023. pages 4768-4777, ACM, 2023. [doi]

Abstract is missing.

runs on WebDSL