What you say is what you get: Text-aligned semantic reward modeling with vision-language representations for reinforcement learning

Wei He, Yukun Xiao, Liqian Ma, Yisheng An, Bo Sun 0017, Yaxian Wang, Jun Liu 0002. What you say is what you get: Text-aligned semantic reward modeling with vision-language representations for reinforcement learning. Knowl.-Based Syst., 349:116496, 2026. [doi]

Abstract

Abstract is missing.