Understanding Data Influence in Reinforcement Finetuning

Haoru Tan, Xiuzhe Wu, Sitong Wu, Shaofeng Zhang, Yanfeng Chen, Xingwu Sun, Jeanne Shen, Xiaojuan Qi 0001. Understanding Data Influence in Reinforcement Finetuning. In Danielle Belgrave, Cheng Zhang 0005, Laura N. Montoya, Hsuan-Tien Lin, Razvan Pascanu, Piotr Koniusz, Marzyeh Ghassemi, Nancy Chen, Iván Vladimir Meza Ruíz, Arturo Loaiza-Bonilla, editors, Advances in Neural Information Processing Systems 38: Annual Conference on Neural Information Processing Systems 2025, NeurIPS 2025, San Diago, CA, USA, December 2-7, 2025 / Mexico City, Mexico, November 30 - December 5, 2025. 2025. [doi]

Authors

Haoru Tan

This author has not been identified. Look up 'Haoru Tan' in Google

Xiuzhe Wu

This author has not been identified. Look up 'Xiuzhe Wu' in Google

Sitong Wu

This author has not been identified. Look up 'Sitong Wu' in Google

Shaofeng Zhang

This author has not been identified. Look up 'Shaofeng Zhang' in Google

Yanfeng Chen

This author has not been identified. Look up 'Yanfeng Chen' in Google

Xingwu Sun

This author has not been identified. Look up 'Xingwu Sun' in Google

Jeanne Shen

This author has not been identified. Look up 'Jeanne Shen' in Google

Xiaojuan Qi 0001

This author has not been identified. Look up 'Xiaojuan Qi 0001' in Google