Visual Position Prompt for MLLM Based Visual Grounding

Wei Tang 0011, Yanpeng Sun, Qinying Gu, Zechao Li. Visual Position Prompt for MLLM Based Visual Grounding. IEEE Transactions on Multimedia, 28:3739-3754, 2026. [doi]

Abstract

Abstract is missing.