Multi-Task Reinforcement Learning for Enhanced Multimodal LLM-as-a-Judge

Junjie Wu, Xuan Kan, Zihao He, Shunwen Tan, Bo Pan, Kaitai Zhang. Multi-Task Reinforcement Learning for Enhanced Multimodal LLM-as-a-Judge. In Yunyao Li 0001, Georg Rehm, Mei Tu, editors, Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 6: Industry Track), ACL 2026, San Diego, California, USA, July 2-7, 2026. pages 1829-1847, Association for Computational Linguistics, 2026. [doi]

Abstract

Abstract is missing.