Kejia Chen 0007, Junjun Zheng, Jiawen Zhang 0005, Manxi Lin, Xiao Pan, Jiacong Hu, Jian Lou 0001, Zunlei Feng, Mingli Song. Token-level Inference-Time Alignment for Vision-Language Models. In Maria Liakata, Viviane P. Moreira, Jiajun Zhang 0001, David Jurgens, editors, Findings of the Association for Computational Linguistics, ACL 2026, San Diego, California, United States, July 2-7, 2026. pages 25012-25029, Association for Computational Linguistics, 2026. [doi]
Abstract is missing.