Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes - researchr publication

researchr

You are not signed in
Sign in
Sign up

Cheng-Yu Hsieh, Chun-Liang Li, Chih-Kuan Yeh, Hootan Nakhost, Yasuhisa Fujii, Alex Ratner, Ranjay Krishna, Chen-Yu Lee, Tomas Pfister. Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes. In Anna Rogers, Jordan L. Boyd-Graber, Naoaki Okazaki, editors, Findings of the Association for Computational Linguistics: ACL 2023, Toronto, Canada, July 9-14, 2023. pages 8003-8017, Association for Computational Linguistics, 2023. [doi]

Abstract is missing.

runs on WebDSL