Reward Yourself: Efficient Self Rewards for Trustworthy Sampling

Mingjie Li 0007, Wai Man Si, Michael Backes 0001, Yang Zhang 0016. Reward Yourself: Efficient Self Rewards for Trustworthy Sampling. In Maria Liakata, Viviane P. Moreira, Jiajun Zhang 0001, David Jurgens, editors, Findings of the Association for Computational Linguistics, ACL 2026, San Diego, California, United States, July 2-7, 2026. pages 31070-31086, Association for Computational Linguistics, 2026. [doi]

Abstract

Abstract is missing.