Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning - researchr publication

researchr

You are not signed in
Sign in
Sign up

Kai Wang 0040, Sanket Shah, Haipeng Chen 0001, Andrew Perrault, Finale Doshi-Velez, Milind Tambe. Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning. In Marc'Aurelio Ranzato, Alina Beygelzimer, Yann N. Dauphin, Percy Liang, Jennifer Wortman Vaughan, editors, Advances in Neural Information Processing Systems 34: Annual Conference on Neural Information Processing Systems 2021, NeurIPS 2021, December 6-14, 2021, virtual. pages 8795-8806, 2021. [doi]

Abstract is missing.

runs on WebDSL