Minrui Jiang, Yuning Yang, Xiurui Xie, Pei Ke, Guisong Liu. Safe and effective post-fine-tuning alignment in large language models. Knowl.-Based Syst., 330:114523, 2025. [doi]
@article{JiangYXKL25,
title = {Safe and effective post-fine-tuning alignment in large language models},
author = {Minrui Jiang and Yuning Yang and Xiurui Xie and Pei Ke and Guisong Liu},
year = {2025},
doi = {10.1016/j.knosys.2025.114523},
url = {https://doi.org/10.1016/j.knosys.2025.114523},
researchr = {https://researchr.org/publication/JiangYXKL25},
cites = {0},
citedby = {0},
journal = {Knowl.-Based Syst.},
volume = {330},
pages = {114523},
}