Safe and effective post-fine-tuning alignment in large language models

Minrui Jiang, Yuning Yang, Xiurui Xie, Pei Ke, Guisong Liu. Safe and effective post-fine-tuning alignment in large language models. Knowl.-Based Syst., 330:114523, 2025. [doi]

@article{JiangYXKL25,
  title = {Safe and effective post-fine-tuning alignment in large language models},
  author = {Minrui Jiang and Yuning Yang and Xiurui Xie and Pei Ke and Guisong Liu},
  year = {2025},
  doi = {10.1016/j.knosys.2025.114523},
  url = {https://doi.org/10.1016/j.knosys.2025.114523},
  researchr = {https://researchr.org/publication/JiangYXKL25},
  cites = {0},
  citedby = {0},
  journal = {Knowl.-Based Syst.},
  volume = {330},
  pages = {114523},
}