Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries

Yin Wu 0001, Quanyu Long, Jing Li 0034, Jianfei Yu, Wenya Wang 0001. Visual-RAG: Benchmarking Text-to-Image Retrieval Augmented Generation for Visual Knowledge Intensive Queries. In Alistair Moffat, Falk Scholer, Hannah Bast, Marc Najork, Min Zhang 0006, editors, Proceedings of the 49th International ACM SIGIR Conference on Research and Development in Information Retrieval, SIGIR 2026, MelbourneVICAustralia, July 20-24, 2026. pages 3473-3480, ACM, 2026. [doi]

Abstract

Abstract is missing.