Safe and effective post-fine-tuning alignment in large language models

Minrui Jiang, Yuning Yang, Xiurui Xie, Pei Ke, Guisong Liu. Safe and effective post-fine-tuning alignment in large language models. Knowl.-Based Syst., 330:114523, 2025. [doi]

Abstract

Abstract is missing.