Seunghwan Yu, Homin Park, Byungjin Ko, Jisub Shin, Yoonki Hong, Taejoon Park, Jong-Wan Yoon. The Most Overestimated Q Value Regularization in High-Dimensional Discrete Action Spaces for Offline Reinforcement Learning. IEEE Transactions on Neural Networks, 37(6):2794-2808, June 2026. [doi]
Abstract is missing.