Optimistic Posterior Sampling for Reinforcement Learning with Few Samples and Tight Guarantees - researchr publication

researchr

You are not signed in
Sign in
Sign up

Daniil Tiapkin, Denis Belomestny, Daniele Calandriello, Eric Moulines, Rémi Munos, Alexey Naumov, Mark Rowland, Michal Valko, Pierre Ménard. Optimistic Posterior Sampling for Reinforcement Learning with Few Samples and Tight Guarantees. In Sanmi Koyejo, S. Mohamed, A. Agarwal, Danielle Belgrave, K. Cho, A. Oh, editors, Advances in Neural Information Processing Systems 35: Annual Conference on Neural Information Processing Systems 2022, NeurIPS 2022, New Orleans, LA, USA, November 28 - December 9, 2022. 2022. [doi]

Abstract is missing.

runs on WebDSL