@article{antidotepostfinetuningsafetyalignment, title = {Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning}, author = {Tiansheng Huang and Gautam Bhattacharya and Pratik Joshi and Josh Kimball and Ling Liu}, year = {2024}, eprint = {2408.09600}, archivePrefix = {arXiv}, url = {https://arxiv.org/abs/2408.09600v2}, }