Diverse Policies Converge in Reward-Free Markov Decision Processes

Fanqi Lin, Shiyu Huang, Wei-Wei Tu. Diverse Policies Converge in Reward-Free Markov Decision Processes. In Fenrong Liu, Arun Anand Sadanandan, Duc Nghia Pham, Petrus Mursanto, Dickson Lukose, editors, PRICAI 2023: Trends in Artificial Intelligence - 20th Pacific Rim International Conference on Artificial Intelligence, PRICAI 2023, Jakarta, Indonesia, November 15-19, 2023, Proceedings, Part I. Volume 14325 of Lecture Notes in Computer Science, pages 125-136, Springer, 2022. [doi]

@inproceedings{LinHT22,
  title = {Diverse Policies Converge in Reward-Free Markov Decision Processes},
  author = {Fanqi Lin and Shiyu Huang and Wei-Wei Tu},
  year = {2022},
  doi = {10.1007/978-981-99-7019-3_13},
  url = {https://doi.org/10.1007/978-981-99-7019-3_13},
  researchr = {https://researchr.org/publication/LinHT22},
  cites = {0},
  citedby = {0},
  pages = {125-136},
  booktitle = {PRICAI 2023: Trends in Artificial Intelligence - 20th Pacific Rim International Conference on Artificial Intelligence, PRICAI 2023, Jakarta, Indonesia, November 15-19, 2023, Proceedings, Part I},
  editor = {Fenrong Liu and Arun Anand Sadanandan and Duc Nghia Pham and Petrus Mursanto and Dickson Lukose},
  volume = {14325},
  series = {Lecture Notes in Computer Science},
  publisher = {Springer},
  isbn = {978-981-99-7019-3},
}