PPF: A framework for real-time adaptive pruning of large language models via performance prediction

Zuxin Ma, Yunhe Cui, Yongbin Qin. PPF: A framework for real-time adaptive pruning of large language models via performance prediction. Neurocomputing, 697:134183, 2026. [doi]

Abstract

Abstract is missing.